Home Progetti RPG-DiffusionMaster
RPG-DiffusionMaster

RPG-DiffusionMaster

di YangLing0818 · GitHub

[ICML 2024] Mastering Text-to-Image Diffusion: Recaptioning, Planning, and Generating with Multimodal LLMs (RPG)

Visualizza su GitHub
In parole semplici

Genera e modifica immagini da descrizioni testuali utilizzando modelli AI avanzati in un Jupyter Notebook.

⭐ Stelle
🍴 Fork
🔥 Tendenze
📜 Licenza
Uso commerciale consentito
📅 Creato
🔄 Ultimo commit
🏷️ Categoria
💻 Lingua
Mantieni questo progetto?

Rivendica la sua pagina: indicizzata qualunque sia il rango, tradotta in sei lingue e arricchita con le tue parole.

Rivendica questa pagina →
RPG-DiffusionMaster — GitHub preview card
📈 Storia delle stelle
1 8411 838
2026-07-202026-07-29
📈 Segui RPG-DiffusionMaster

Ricevi un avviso via email alla prossima release o quando decolla — non perderti nulla.

Gratis · senza carta · disdici quando vuoi
Ricevi avvisi via email →
📄 Informazioni

[ICML 2024] Mastering Text-to-Image Diffusion: Recaptioning, Planning, and Generating with Multimodal LLMs (RPG)

RPG-DiffusionMaster ha 1.8k stelle su GitHub. È stato forkato 100 volte. RPG-DiffusionMaster è scritto principalmente in Jupyter Notebook. È in sviluppo attivo dal 2024. RPG-DiffusionMaster è disponibile con licenza MIT. I suoi temi principali sono: image-editting, large-language-models, multimodal-large-language-models, text-to-image.

Frequently asked questions

Che cos'è RPG-DiffusionMaster?

[ICML 2024] Mastering Text-to-Image Diffusion: Recaptioning, Planning, and Generating with Multimodal LLMs (RPG)

RPG-DiffusionMaster è open source?

RPG-DiffusionMaster è un progetto open source. È rilasciato con licenza MIT.

RPG-DiffusionMaster è gratuito?

Sì. RPG-DiffusionMaster è gratuito e open source: puoi usarlo, modificarlo e ospitarlo autonomamente.

Con quale licenza è RPG-DiffusionMaster?

RPG-DiffusionMaster è disponibile con licenza MIT.

In quale linguaggio è scritto RPG-DiffusionMaster?

RPG-DiffusionMaster è scritto principalmente in Jupyter Notebook.

🏅 Manutentore di questo progetto?
OpenSourceAI badge — RPG-DiffusionMaster

Aggiungi questo badge live al tuo README — le tue stelle GitHub e il ranking della directory, aggiornati quotidianamente.

[![OpenSourceAI](https://opensourceai.tech/badge.php?tool=yangling0818-rpg-diffusionmaster)](https://opensourceai.tech/project/yangling0818-rpg-diffusionmaster.html)
Altre opzioni di badge →
🧬 Condivide il DNA con🧬 Vedi la mappa del DNA →
Ovis-U1
Un modello unificato che integra senza soluzione di continuità comprensione multimodale, genera…
450 · image-editing
condividemultimodal-large-language-modelstext-to-image
Ovis-Image
Ovis-Image è un modello text-to-image da 7B specificamente ottimizzato per il rendering di test…
321 · image-generation
condividetext-to-image
Awesome-Medical-Large-Language-Models
Articoli curati sui modelli di linguaggio di grandi dimensioni nel settore sanitario e medico
393 · large-language-models
condividemultimodal-large-language-models
DALLE2-pytorch
Implementazione di DALL-E 2, la rete neurale di sintesi testo-immagine aggiornata di OpenAI, in…
11.3k · artificial-intelligence
condividetext-to-image
DF-GAN
[CVPR2022 orale] Una base semplice ed efficace per la sintesi testo-immagine
326 · generative-adversarial-network
condividetext-to-image
Liquid
(Accettato da IJCV) Liquid: I modelli di linguaggio sono generatori multi-modali scalabili e un…
642 · autoregressive-models
condividemultimodal-large-language-modelstext-to-image
VQGAN-CLIP
Sto solo provando a far funzionare VQGAN+CLIP localmente, piuttosto che dover usare colab.
2.6k · text-to-image
condividetext-to-image
Attend-and-Excite
Implementazione ufficiale per "Attend-and-Excite: Guida Semantica Basata su Attenzione per Mode…
770 · diffusion-models
condividetext-to-image
star-vector
StarVector è un modello di base per la generazione di SVG che trasforma la vettorizzazione in u…
4.5k · llm
condividemultimodal-large-language-models
min-dalle
min(DALL·E) è un port veloce e minimale di DALL·E Mini su PyTorch
3.5k · artificial-intelligence
condividetext-to-image

Misurato dai topic GitHub comuni a entrambi i progetti, ponderati per la loro rarita.