Inicio Proyectos RPG-DiffusionMaster
RPG-DiffusionMaster
Jupyter Notebook

RPG-DiffusionMaster

[ICML 2024] Dominando la Difusión de Texto a Imagen: Recaptioning, Planificación y Generación con LLMs Multimodales (RPG)

por YangLing0818 · GitHub
Estrellas
Ramas
Tendencias
Licencia
Creado
Último commit
Categoría
image-edittinglarge-language-modelsmultimodal-large-language-modelsMITJupyter Notebook
Ver en GitHub
En palabras simples

Genera y edita imágenes a partir de descripciones de texto utilizando modelos de IA avanzados en un Jupyter Notebook.

¿Mantienes este proyecto?

Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.

Reivindicar esta pagina →
RPG-DiffusionMaster — GitHub preview card
📈 Historial de estrellas
1 8441 838
2026-07-202026-08-31
📈 Sigue RPG-DiffusionMaster

Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.

Gratis · sin tarjeta · cancela cuando quieras
Recibir alertas por email →
📄 Acerca de

[ICML 2024] Dominando la Difusión de Texto a Imagen: Recaptioning, Planificación y Generación con LLMs Multimodales (RPG)

RPG-DiffusionMaster tiene 1.8k estrellas en GitHub. Se ha bifurcado 100 veces. RPG-DiffusionMaster está escrito principalmente en Jupyter Notebook. Se desarrolla activamente desde 2024. RPG-DiffusionMaster está disponible bajo la licencia MIT. Sus temas principales son: image-editting, large-language-models, multimodal-large-language-models, text-to-image.

Frequently asked questions

¿Qué es RPG-DiffusionMaster?

[ICML 2024] Dominando la Difusión de Texto a Imagen: Recaptioning, Planificación y Generación con LLMs Multimodales (RPG)

¿RPG-DiffusionMaster es de código abierto?

RPG-DiffusionMaster es un proyecto de código abierto. Se distribuye bajo la licencia MIT.

¿RPG-DiffusionMaster es gratis?

Sí. RPG-DiffusionMaster es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.

¿Bajo qué licencia está RPG-DiffusionMaster?

RPG-DiffusionMaster está disponible bajo la licencia MIT.

¿En qué lenguaje está escrito RPG-DiffusionMaster?

RPG-DiffusionMaster está escrito principalmente en Jupyter Notebook.

🏅 ¿Mantenedor de este proyecto?
olud.ai badge — RPG-DiffusionMaster

Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.

[![olud.ai](https://olud.ai/badge.php?tool=yangling0818-rpg-diffusionmaster)](https://olud.ai/project/yangling0818-rpg-diffusionmaster.html)
Más opciones de distintivos →
🧬 Comparte ADN con🧬 Ver el mapa de ADN →
Ovis-U1
Un modelo unificado que integra sin problemas comprensión multimodal, generación de texto a ima…
450 · image-editing
compartemultimodal-large-language-modelstext-to-image
Magic-Me
Códigos para Difusión Personalizada de Video Específica de ID
460 · diffusion-models
comparteimage-editting
Ovis-Image
Ovis-Image es un modelo de texto a imagen de 7B específicamente optimizado para renderizado de…
318 · image-generation
compartetext-to-image
DALLE2-pytorch
Implementación de DALL-E 2, la red neuronal de síntesis de texto a imagen actualizada de OpenAI…
11.3k · artificial-intelligence
compartetext-to-image
DF-GAN
[CVPR2022 oral] Una base simple y efectiva para la síntesis de texto a imagen
326 · generative-adversarial-network
compartetext-to-image
Awesome-Medical-Large-Language-Models
Artículos seleccionados sobre Modelos de Lenguaje Grande en el ámbito de la Salud y Medicina
390 · large-language-models
compartemultimodal-large-language-models
Liquid
(Aceptado por IJCV) Liquid: Los Modelos de Lenguaje son Generadores Multi-modal Escalables y Un…
640 · autoregressive-models
compartemultimodal-large-language-modelstext-to-image
Spatial-MLLM
[NeurIPS 2025 Spotlight] Implementación oficial de Spatial-MLLM: Mejorando las Capacidades de M…
477 · aigc
compartemultimodal-large-language-models
VQGAN-CLIP
Solo jugando con hacer funcionar VQGAN+CLIP localmente, en lugar de tener que usar colab.
2.7k · text-to-image
compartetext-to-image
Attend-and-Excite
Implementación oficial para "Attend-and-Excite: Guía Semántica Basada en Atención para Modelos…
772 · diffusion-models
compartetext-to-image

Medido a partir de los topics de GitHub comunes a ambos proyectos, ponderados por su rareza.