Implementación para Rollout FP8/INT8 para entrenamiento RL sin caída de rendimiento.
Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.
Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.
Gratis · sin tarjeta · cancela cuando quierasImplementación para Rollout FP8/INT8 para entrenamiento RL sin caída de rendimiento.
Flash-RL tiene 307 estrellas en GitHub. Se ha bifurcado 23 veces. Flash-RL está escrito principalmente en Python. Se desarrolla activamente desde 2025. Flash-RL está disponible bajo la licencia MIT. Sus temas principales son: reinforcement-learning, vllm.
Implementación para Rollout FP8/INT8 para entrenamiento RL sin caída de rendimiento.
Flash-RL es un proyecto de código abierto. Se distribuye bajo la licencia MIT.
Sí. Flash-RL es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.
Flash-RL está disponible bajo la licencia MIT.
Flash-RL está escrito principalmente en Python.
Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.
[](https://olud.ai/project/yaof20-flash-rl.html)
Medido a partir de los topics de GitHub comunes a ambos proyectos, ponderados por su rareza.