Home Progetti RPG-DiffusionMaster
RPG-DiffusionMaster
Jupyter Notebook

RPG-DiffusionMaster

[ICML 2024] Mastering Text-to-Image Diffusion: Recaptioning, Planning, and Generating with Multimodal LLMs (RPG)

di YangLing0818 · GitHub
Stelle
Fork
Licenza
Creato
Ultimo commit
image-edittinglarge-language-modelsmultimodal-large-language-modelsMITJupyter Notebook
Visualizza su GitHub
In parole semplici

Genera e modifica immagini da descrizioni testuali utilizzando modelli AI avanzati in un Jupyter Notebook.

Mantieni questo progetto?

Rivendica la sua pagina: indicizzata qualunque sia il rango, tradotta in sei lingue e arricchita con le tue parole.

Rivendica questa pagina →
RPG-DiffusionMaster — GitHub preview card
📈 Storia delle stelle
1 8441 838
2026-07-202026-08-31
📈 Segui RPG-DiffusionMaster

Ricevi un avviso via email alla prossima release o quando decolla — non perderti nulla.

Gratis · senza carta · disdici quando vuoi
Ricevi avvisi via email →
📄 Informazioni

[ICML 2024] Mastering Text-to-Image Diffusion: Recaptioning, Planning, and Generating with Multimodal LLMs (RPG)

RPG-DiffusionMaster ha 1.8k stelle su GitHub. È stato forkato 100 volte. RPG-DiffusionMaster è scritto principalmente in Jupyter Notebook. È in sviluppo attivo dal 2024. RPG-DiffusionMaster è disponibile con licenza MIT. I suoi temi principali sono: image-editting, large-language-models, multimodal-large-language-models, text-to-image.

Frequently asked questions

Che cos'è RPG-DiffusionMaster?

[ICML 2024] Mastering Text-to-Image Diffusion: Recaptioning, Planning, and Generating with Multimodal LLMs (RPG)

RPG-DiffusionMaster è open source?

RPG-DiffusionMaster è un progetto open source. È rilasciato con licenza MIT.

RPG-DiffusionMaster è gratuito?

Sì. RPG-DiffusionMaster è gratuito e open source: puoi usarlo, modificarlo e ospitarlo autonomamente.

Con quale licenza è RPG-DiffusionMaster?

RPG-DiffusionMaster è disponibile con licenza MIT.

In quale linguaggio è scritto RPG-DiffusionMaster?

RPG-DiffusionMaster è scritto principalmente in Jupyter Notebook.

🏅 Manutentore di questo progetto?
olud.ai badge — RPG-DiffusionMaster

Aggiungi questo badge live al tuo README — le tue stelle GitHub e il ranking della directory, aggiornati quotidianamente.

[![olud.ai](https://olud.ai/badge.php?tool=yangling0818-rpg-diffusionmaster)](https://olud.ai/project/yangling0818-rpg-diffusionmaster.html)
Altre opzioni di badge →
🧬 Condivide il DNA con🧬 Vedi la mappa del DNA →
Ovis-U1
Un modello unificato che integra senza soluzione di continuità comprensione multimodale, genera…
450 · image-editing
condividemultimodal-large-language-modelstext-to-image
Magic-Me
Codici per Diffusione Video Personalizzata Specifica per ID
460 · diffusion-models
condivideimage-editting
Ovis-Image
Ovis-Image è un modello text-to-image da 7B specificamente ottimizzato per il rendering di test…
318 · image-generation
condividetext-to-image
DALLE2-pytorch
Implementazione di DALL-E 2, la rete neurale di sintesi testo-immagine aggiornata di OpenAI, in…
11.3k · artificial-intelligence
condividetext-to-image
DF-GAN
[CVPR2022 orale] Una base semplice ed efficace per la sintesi testo-immagine
326 · generative-adversarial-network
condividetext-to-image
Awesome-Medical-Large-Language-Models
Articoli curati sui modelli di linguaggio di grandi dimensioni nel settore sanitario e medico
390 · large-language-models
condividemultimodal-large-language-models
Liquid
(Accettato da IJCV) Liquid: I modelli di linguaggio sono generatori multi-modali scalabili e un…
640 · autoregressive-models
condividemultimodal-large-language-modelstext-to-image
Spatial-MLLM
[NeurIPS 2025 Spotlight] Implementazione ufficiale di Spatial-MLLM: Potenziamento delle Capacit…
477 · aigc
condividemultimodal-large-language-models
VQGAN-CLIP
Sto solo provando a far funzionare VQGAN+CLIP localmente, piuttosto che dover usare colab.
2.7k · text-to-image
condividetext-to-image
Attend-and-Excite
Implementazione ufficiale per "Attend-and-Excite: Guida Semantica Basata su Attenzione per Mode…
772 · diffusion-models
condividetext-to-image

Misurato dai topic GitHub comuni a entrambi i progetti, ponderati per la loro rarita.