Accueil Projets RPG-DiffusionMaster
RPG-DiffusionMaster
Jupyter Notebook

RPG-DiffusionMaster

[ICML 2024] Maîtriser la diffusion texte-image : Recaptioning, planification et génération avec des LLM multimodaux (RPG)

par YangLing0818 · GitHub
Étoiles
Forks
Licence
Créé
Dernier commit
Catégorie
image-edittinglarge-language-modelsmultimodal-large-language-modelsMITJupyter Notebook
Voir sur GitHub
En termes simples

Générez et éditez des images à partir de descriptions textuelles en utilisant des modèles IA avancés dans un Jupyter Notebook.

Vous maintenez ce projet ?

Revendiquez sa page : indexée quel que soit son rang, traduite en six langues, et enrichie de vos propres mots.

Revendiquer cette page →
RPG-DiffusionMaster — GitHub preview card
📈 Historique des étoiles
1 8441 838
2026-07-202026-08-31
📈 Suivez RPG-DiffusionMaster

Recevez une alerte par e-mail à sa prochaine version ou quand il décolle — ne ratez plus rien.

Gratuit · sans carte · désinscription à tout moment
Recevoir des alertes e-mail →
📄 À propos

[ICML 2024] Maîtriser la diffusion texte-image : Recaptioning, planification et génération avec des LLM multimodaux (RPG)

RPG-DiffusionMaster compte 1.8k étoiles sur GitHub. Il a été forké 100 fois. RPG-DiffusionMaster est écrit principalement en Jupyter Notebook. Il est développé activement depuis 2024. RPG-DiffusionMaster est disponible sous licence MIT. Ses principaux thèmes sont : image-editting, large-language-models, multimodal-large-language-models, text-to-image.

Frequently asked questions

Qu'est-ce que RPG-DiffusionMaster ?

[ICML 2024] Maîtriser la diffusion texte-image : Recaptioning, planification et génération avec des LLM multimodaux (RPG)

RPG-DiffusionMaster est-il open source ?

RPG-DiffusionMaster est un projet open source. Il est distribué sous licence MIT.

RPG-DiffusionMaster est-il gratuit ?

Oui. RPG-DiffusionMaster est gratuit et open source — vous pouvez l'utiliser, le modifier et l'héberger vous-même.

Sous quelle licence est RPG-DiffusionMaster ?

RPG-DiffusionMaster est disponible sous licence MIT.

Dans quel langage RPG-DiffusionMaster est-il écrit ?

RPG-DiffusionMaster est écrit principalement en Jupyter Notebook.

🏅 Mainteneur de ce projet ?
olud.ai badge — RPG-DiffusionMaster

Ajoutez ce badge en direct à votre README — vos étoiles GitHub et votre classement dans le répertoire, actualisés quotidiennement.

[![olud.ai](https://olud.ai/badge.php?tool=yangling0818-rpg-diffusionmaster)](https://olud.ai/project/yangling0818-rpg-diffusionmaster.html)
Plus d'options de badge →
🧬 Partage son ADN avec🧬 Voir la cartographie ADN →
Ovis-U1
Un modèle unifié qui intègre parfaitement la compréhension multimodale, la génération de texte…
450 · image-editing
partagemultimodal-large-language-modelstext-to-image
Magic-Me
Codes pour la diffusion vidéo personnalisée spécifique à l'ID
460 · diffusion-models
partageimage-editting
Ovis-Image
Ovis-Image est un modèle texte-à-image de 7B spécifiquement optimisé pour un rendu textuel de h…
318 · image-generation
partagetext-to-image
DALLE2-pytorch
Implémentation de DALL-E 2, le réseau de neurones de synthèse texte-image mis à jour d'OpenAI,…
11.3k · artificial-intelligence
partagetext-to-image
DF-GAN
[CVPR2022 oral] Une base simple et efficace pour la synthèse texte-image
326 · generative-adversarial-network
partagetext-to-image
Awesome-Medical-Large-Language-Models
Articles sélectionnés sur les grands modèles de langage dans le domaine de la santé et médical
390 · large-language-models
partagemultimodal-large-language-models
Liquid
(Accepté par IJCV) Liquid : Les modèles de langage sont évolutifs et générateurs multimodaux un…
640 · autoregressive-models
partagemultimodal-large-language-modelstext-to-image
Spatial-MLLM
[NeurIPS 2025 Spotlight] Implémentation officielle de Spatial-MLLM : Amélioration des Capacités…
477 · aigc
partagemultimodal-large-language-models
VQGAN-CLIP
Juste en train de jouer avec l'exécution de VQGAN+CLIP localement, plutôt que d'avoir à utilise…
2.7k · text-to-image
partagetext-to-image
Attend-and-Excite
Implémentation officielle pour "Attend-and-Excite: Attention-Based Semantic Guidance for Text-t…
772 · diffusion-models
partagetext-to-image

Mesuré à partir des topics GitHub communs aux deux projets, pondérés par leur rareté.