Inicio Proyectos Awesome-RL-for-Video-Generation
Awesome-RL-for-Video-Generation
dpo

Awesome-RL-for-Video-Generation

Una lista curada de artículos sobre aprendizaje por refuerzo para la generación de video

por wendell0218 · GitHub
Estrellas
Ramas
Creado
Último commit
Categoría
dpogrpoppo
Ver en GitHub
En palabras simples

Explora una colección de artículos de investigación sobre el uso del aprendizaje por refuerzo para generar videos.

¿Mantienes este proyecto?

Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.

Reivindicar esta pagina →
Awesome-RL-for-Video-Generation — GitHub preview card
📈 Historial de estrellas
566565
2026-07-202026-08-31
📈 Sigue Awesome-RL-for-Video-Generation

Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.

Gratis · sin tarjeta · cancela cuando quieras
Recibir alertas por email →
📄 Acerca de

Una lista curada de artículos sobre aprendizaje por refuerzo para la generación de video

Awesome-RL-for-Video-Generation tiene 565 estrellas en GitHub. Se ha bifurcado 3 veces. Se desarrolla activamente desde 2025. Sus temas principales son: dpo, grpo, ppo, reinforcement-learning.

Frequently asked questions

¿Qué es Awesome-RL-for-Video-Generation?

Una lista curada de artículos sobre aprendizaje por refuerzo para la generación de video

¿Awesome-RL-for-Video-Generation es de código abierto?

Awesome-RL-for-Video-Generation es un proyecto de código abierto.

¿Awesome-RL-for-Video-Generation es gratis?

Sí. Awesome-RL-for-Video-Generation es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.

🏅 ¿Mantenedor de este proyecto?
olud.ai badge — Awesome-RL-for-Video-Generation

Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.

[![olud.ai](https://olud.ai/badge.php?tool=wendell0218-awesome-rl-for-video-generation)](https://olud.ai/project/wendell0218-awesome-rl-for-video-generation.html)
Más opciones de distintivos →
🧬 Comparte ADN con🧬 Ver el mapa de ADN →
PPO-for-Beginners
Una implementación PPO simple y bien estilizada. Basada en mi serie de Medium: https://medium.c…
1.3k · machine-learning
compartepporeinforcement-learning
MixGRPO
[ECCV 2026] MixGRPO: Desbloqueando la eficiencia de GRPO basada en flujo con ODE-SDE mixto
1.2k · diffusion
compartegrporeinforcement-learning
purejaxrl
Implementaciones de Jax RL de extremo a extremo realmente rápidas
1.1k · deep-reinforcement-learning
compartepporeinforcement-learning
ABC-GRPO
Código para Adaptive-Boundary-Clipping GRPO. arxiv.org/pdf/2601.03895
442 · grpo
compartegrporeinforcement-learning
rl-collision-avoidance
Implementación del artículo "Hacia una Evitación de Colisiones Multi-Robot Óptimamente Descentr…
458 · collision-avoidance
compartepporeinforcement-learning
hands-on-modern-rl
🚀 Un currículo práctico y de código abierto que cierra la brecha desde conceptos básicos de RL…
4.2k · agent
comparteppodpo
OpenThinkIMG
OpenThinkIMG es un marco de código abierto de extremo a extremo que empodera a los LVLM para pe…
397 · grpo
compartegrporeinforcement-learning
PPO-PyTorch
Implementación mínima de la optimización de política proximal (PPO) con objetivo recortado en P…
2.4k · deep-learning
comparteppo
verl-omni
Marco de entrenamiento RL multimodal para modelos de difusión y omni
908 · diffusion-models
compartegrporeinforcement-learning
ART
Entrenador de Refuerzo de Agentes: entrena agentes de múltiples pasos para tareas del mundo rea…
10.5k · agent
compartegrpo

Medido a partir de los topics de GitHub comunes a ambos proyectos, ponderados por su rareza.