Inicio Proyectos Flash-RL
Flash-RL
Python

Flash-RL

Implementación para Rollout FP8/INT8 para entrenamiento RL sin caída de rendimiento.

por yaof20 · GitHub
Estrellas
Ramas
Licencia
Creado
Último commit
Lenguaje
reinforcement-learningvllmMITPython
Ver en GitHub
En palabras simples

Entrena modelos de aprendizaje por refuerzo rápidamente utilizando técnicas avanzadas sin perder rendimiento.

¿Mantienes este proyecto?

Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.

Reivindicar esta pagina →
Flash-RL — GitHub preview card
📈 Historial de estrellas
307306
2026-07-202026-08-17
📈 Sigue Flash-RL

Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.

Gratis · sin tarjeta · cancela cuando quieras
Recibir alertas por email →
📄 Acerca de

Implementación para Rollout FP8/INT8 para entrenamiento RL sin caída de rendimiento.

Flash-RL tiene 306 estrellas en GitHub. Se ha bifurcado 23 veces. Flash-RL está escrito principalmente en Python. Se desarrolla activamente desde 2025. Flash-RL está disponible bajo la licencia MIT. Sus temas principales son: reinforcement-learning, vllm.

Frequently asked questions

¿Qué es Flash-RL?

Implementación para Rollout FP8/INT8 para entrenamiento RL sin caída de rendimiento.

¿Flash-RL es de código abierto?

Flash-RL es un proyecto de código abierto. Se distribuye bajo la licencia MIT.

¿Flash-RL es gratis?

Sí. Flash-RL es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.

¿Bajo qué licencia está Flash-RL?

Flash-RL está disponible bajo la licencia MIT.

¿En qué lenguaje está escrito Flash-RL?

Flash-RL está escrito principalmente en Python.

🏅 ¿Mantenedor de este proyecto?
olud.ai badge — Flash-RL

Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.

[![olud.ai](https://olud.ai/badge.php?tool=yaof20-flash-rl)](https://olud.ai/project/yaof20-flash-rl.html)
Más opciones de distintivos →
🧬 Comparte ADN con🧬 Ver el mapa de ADN →
UniRL
UniRL es un marco para el aprendizaje por refuerzo de modelos multimodales unificados.
820 · ai-infrastructure
compartevllmreinforcement-learning
PufferLib
Aumentando el aprendizaje por refuerzo
6.2k · reinforcement-learning
compartereinforcement-learning
sample-factory
Aprendizaje por refuerzo sincrónico y asincrónico de alto rendimiento
1k · reinforcement-learning
compartereinforcement-learning
hok_env
Honor of Kings AI Open Environment de Tencent
885 · reinforcement-learning
compartereinforcement-learning
Deep-Learning-Roadmap
:satellite: Recursos Organizados para Investigadores y Desarrolladores de Aprendizaje Profundo
3.2k · deep-learning
compartereinforcement-learning
baby-steps-of-rl-ja
Aprendiendo refuerzo con Python - Desde la introducción hasta la práctica - Código de muestra
453 · machine-learning
compartereinforcement-learning
reinforcement-learning-an-introduction
Soluciones a ejercicios en Aprendizaje por Refuerzo: Una Introducción (2ª Edición).
412 · python
compartereinforcement-learning
RoboBrain
[CVPR 2025] RoboBrain: Un Modelo Cerebral Unificado para la Manipulación Robótica de Abstracto…
559 · embodied-ai
compartevllm
reinforcement-learning-an-introduction
Implementación en Python del Aprendizaje por Refuerzo: Una Introducción
14.7k · artificial-intelligence
compartereinforcement-learning
GOPS
Solucionador General de Problemas de Control Óptimo (GOPS), un paquete de solucionador de apren…
304 · pytorch
compartereinforcement-learning

Medido a partir de los topics de GitHub comunes a ambos proyectos, ponderados por su rareza.