Startseite Projekte RPG-DiffusionMaster
RPG-DiffusionMaster

RPG-DiffusionMaster

von YangLing0818 · GitHub

[ICML 2024] Mastering Text-to-Image Diffusion: Recaptioning, Planning, and Generating with Multimodal LLMs (RPG)

Auf GitHub ansehen
In einfachen Worten

Generieren und bearbeiten Sie Bilder aus Textbeschreibungen mithilfe fortschrittlicher KI-Modelle in einem Jupyter Notebook.

⭐ Sterne
🍴 Forks
🔥 Trendend
📜 Lizenz
Kommerzielle Nutzung erlaubt
📅 Erstellt
🔄 Letzter Commit
🏷️ Kategorie
💻 Sprache
Betreuen Sie dieses Projekt?

Beanspruchen Sie die Seite: indexiert unabhangig vom Rang, in sechs Sprachen ubersetzt und mit Ihren eigenen Worten erganzt.

Diese Seite beanspruchen →
RPG-DiffusionMaster — GitHub preview card
📈 Sternhistorie
1 8411 838
2026-07-202026-07-29
📈 RPG-DiffusionMaster verfolgen

Erhalten Sie eine E-Mail-Benachrichtigung beim nächsten Release oder wenn es durchstartet.

Kostenlos · ohne Karte · jederzeit abbestellbar
E-Mail-Alerts erhalten →
📄 Über

[ICML 2024] Mastering Text-to-Image Diffusion: Recaptioning, Planning, and Generating with Multimodal LLMs (RPG)

RPG-DiffusionMaster hat 1.8k Sterne auf GitHub. Es wurde 100-mal geforkt. RPG-DiffusionMaster ist hauptsächlich in Jupyter Notebook geschrieben. Es wird seit 2024 aktiv entwickelt. RPG-DiffusionMaster ist unter der MIT-Lizenz verfügbar. Die Hauptthemen sind: image-editting, large-language-models, multimodal-large-language-models, text-to-image.

Frequently asked questions

Was ist RPG-DiffusionMaster?

[ICML 2024] Mastering Text-to-Image Diffusion: Recaptioning, Planning, and Generating with Multimodal LLMs (RPG)

Ist RPG-DiffusionMaster Open Source?

RPG-DiffusionMaster ist ein Open-Source-Projekt. Es wird unter der MIT-Lizenz veröffentlicht.

Ist RPG-DiffusionMaster kostenlos?

Ja. RPG-DiffusionMaster ist kostenlos und Open Source — Sie können es nutzen, anpassen und selbst hosten.

Unter welcher Lizenz steht RPG-DiffusionMaster?

RPG-DiffusionMaster ist unter der MIT-Lizenz verfügbar.

In welcher Sprache ist RPG-DiffusionMaster geschrieben?

RPG-DiffusionMaster ist hauptsächlich in Jupyter Notebook geschrieben.

🏅 Wartender dieses Projekts?
OpenSourceAI badge — RPG-DiffusionMaster

Fügen Sie dieses Live-Abzeichen zu Ihrem README hinzu — Ihre GitHub-Sterne und Verzeichnisrang, täglich aktualisiert.

[![OpenSourceAI](https://opensourceai.tech/badge.php?tool=yangling0818-rpg-diffusionmaster)](https://opensourceai.tech/project/yangling0818-rpg-diffusionmaster.html)
Weitere Abzeichenoptionen →
🧬 Teilt DNA mit🧬 DNA-Karte ansehen →
Ovis-U1
Ein einheitliches Modell, das multimodales Verständnis, Text-zu-Bild-Generierung und Bildbearbe…
450 · image-editing
teiltmultimodal-large-language-modelstext-to-image
Ovis-Image
Ovis-Image ist ein 7B Text-zu-Bild-Modell, das speziell für hochwertige Textdarstellung optimie…
321 · image-generation
teilttext-to-image
Awesome-Medical-Large-Language-Models
Kuratiertes Papier zu großen Sprachmodellen im Gesundheitswesen und medizinischen Bereich
393 · large-language-models
teiltmultimodal-large-language-models
DALLE2-pytorch
Implementierung von DALL-E 2, OpenAIs aktualisiertem Text-zu-Bild-Synthese-Neuronalen Netzwerk…
11.3k · artificial-intelligence
teilttext-to-image
DF-GAN
[CVPR2022 Oral] Eine einfache und effektive Basislinie für Text-zu-Bild-Synthese
326 · generative-adversarial-network
teilttext-to-image
Liquid
(Akzeptiert von IJCV) Liquid: Sprachmodelle sind skalierbar und einheitliche multimodale Genera…
642 · autoregressive-models
teiltmultimodal-large-language-modelstext-to-image
VQGAN-CLIP
Ich spiele nur damit, VQGAN+CLIP lokal zum Laufen zu bringen, anstatt Colab verwenden zu müssen…
2.6k · text-to-image
teilttext-to-image
Attend-and-Excite
Offizielle Implementierung für "Attend-and-Excite: Attention-Based Semantic Guidance for Text-t…
770 · diffusion-models
teilttext-to-image
star-vector
StarVector ist ein Basis-Modell zur SVG-Generierung, das die Vektorisierung in eine Code-Generi…
4.5k · llm
teiltmultimodal-large-language-models
min-dalle
min(DALL·E) ist ein schneller, minimaler Port von DALL·E Mini zu PyTorch
3.5k · artificial-intelligence
teilttext-to-image

Ermittelt aus gemeinsamen GitHub-Topics beider Projekte, gewichtet nach ihrer Seltenheit.