Startseite Projekte RPG-DiffusionMaster
RPG-DiffusionMaster
Jupyter Notebook

RPG-DiffusionMaster

[ICML 2024] Mastering Text-to-Image Diffusion: Recaptioning, Planning, and Generating with Multimodal LLMs (RPG)

von YangLing0818 · GitHub
Sterne
Forks
Lizenz
Erstellt
Letzter Commit
image-edittinglarge-language-modelsmultimodal-large-language-modelsMITJupyter Notebook
Auf GitHub ansehen
In einfachen Worten

Generiere und bearbeite Bilder aus Textbeschreibungen mit fortschrittlichen KI-Modellen in einem Jupyter Notebook.

Betreuen Sie dieses Projekt?

Beanspruchen Sie die Seite: indexiert unabhangig vom Rang, in sechs Sprachen ubersetzt und mit Ihren eigenen Worten erganzt.

Diese Seite beanspruchen →
RPG-DiffusionMaster — GitHub preview card
📈 Sternhistorie
1 8441 838
2026-07-202026-08-31
📈 RPG-DiffusionMaster verfolgen

Erhalten Sie eine E-Mail-Benachrichtigung beim nächsten Release oder wenn es durchstartet.

Kostenlos · ohne Karte · jederzeit abbestellbar
E-Mail-Alerts erhalten →
📄 Über

[ICML 2024] Mastering Text-to-Image Diffusion: Recaptioning, Planning, and Generating with Multimodal LLMs (RPG)

RPG-DiffusionMaster hat 1.8k Sterne auf GitHub. Es wurde 100-mal geforkt. RPG-DiffusionMaster ist hauptsächlich in Jupyter Notebook geschrieben. Es wird seit 2024 aktiv entwickelt. RPG-DiffusionMaster ist unter der MIT-Lizenz verfügbar. Die Hauptthemen sind: image-editting, large-language-models, multimodal-large-language-models, text-to-image.

Frequently asked questions

Was ist RPG-DiffusionMaster?

[ICML 2024] Mastering Text-to-Image Diffusion: Recaptioning, Planning, and Generating with Multimodal LLMs (RPG)

Ist RPG-DiffusionMaster Open Source?

RPG-DiffusionMaster ist ein Open-Source-Projekt. Es wird unter der MIT-Lizenz veröffentlicht.

Ist RPG-DiffusionMaster kostenlos?

Ja. RPG-DiffusionMaster ist kostenlos und Open Source — Sie können es nutzen, anpassen und selbst hosten.

Unter welcher Lizenz steht RPG-DiffusionMaster?

RPG-DiffusionMaster ist unter der MIT-Lizenz verfügbar.

In welcher Sprache ist RPG-DiffusionMaster geschrieben?

RPG-DiffusionMaster ist hauptsächlich in Jupyter Notebook geschrieben.

🏅 Wartender dieses Projekts?
olud.ai badge — RPG-DiffusionMaster

Fügen Sie dieses Live-Abzeichen zu Ihrem README hinzu — Ihre GitHub-Sterne und Verzeichnisrang, täglich aktualisiert.

[![olud.ai](https://olud.ai/badge.php?tool=yangling0818-rpg-diffusionmaster)](https://olud.ai/project/yangling0818-rpg-diffusionmaster.html)
Weitere Abzeichenoptionen →
🧬 Teilt DNA mit🧬 DNA-Karte ansehen →
Ovis-U1
Ein einheitliches Modell, das multimodales Verständnis, Text-zu-Bild-Generierung und Bildbearbe…
450 · image-editing
teiltmultimodal-large-language-modelstext-to-image
Magic-Me
Codes für ID-spezifische Videoanpassungsdiffusion
460 · diffusion-models
teiltimage-editting
Ovis-Image
Ovis-Image ist ein 7B Text-zu-Bild-Modell, das speziell für hochwertige Textdarstellung optimie…
318 · image-generation
teilttext-to-image
DALLE2-pytorch
Implementierung von DALL-E 2, OpenAIs aktualisiertem Text-zu-Bild-Synthese-Neuronalen Netzwerk…
11.3k · artificial-intelligence
teilttext-to-image
DF-GAN
[CVPR2022 Oral] Eine einfache und effektive Basislinie für Text-zu-Bild-Synthese
326 · generative-adversarial-network
teilttext-to-image
Awesome-Medical-Large-Language-Models
Kuratiertes Papier zu großen Sprachmodellen im Gesundheitswesen und medizinischen Bereich
390 · large-language-models
teiltmultimodal-large-language-models
Liquid
(Akzeptiert von IJCV) Liquid: Sprachmodelle sind skalierbar und einheitliche multimodale Genera…
640 · autoregressive-models
teiltmultimodal-large-language-modelstext-to-image
Spatial-MLLM
[NeurIPS 2025 Spotlight] Offizielle Implementierung von Spatial-MLLM: Verbesserung der MLLM-Fäh…
477 · aigc
teiltmultimodal-large-language-models
VQGAN-CLIP
Ich spiele nur damit, VQGAN+CLIP lokal zum Laufen zu bringen, anstatt Colab verwenden zu müssen…
2.7k · text-to-image
teilttext-to-image
Attend-and-Excite
Offizielle Implementierung für "Attend-and-Excite: Attention-Based Semantic Guidance for Text-t…
772 · diffusion-models
teilttext-to-image

Ermittelt aus gemeinsamen GitHub-Topics beider Projekte, gewichtet nach ihrer Seltenheit.