UniRL es un marco para el aprendizaje por refuerzo de modelos multimodales unificados.
Entrena y mejora modelos de IA multimodal usando un marco unificado para el aprendizaje por refuerzo.
Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.
Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.
Gratis · sin tarjeta · cancela cuando quierasUniRL es un marco para el aprendizaje por refuerzo de modelos multimodales unificados.
UniRL tiene 860 estrellas en GitHub. Se ha bifurcado 56 veces. UniRL está escrito principalmente en Python. Se desarrolla activamente desde 2026. Sus temas principales son: ai-infrastructure, reinforcement-learning, sglang, vllm.
UniRL es un marco para el aprendizaje por refuerzo de modelos multimodales unificados.
UniRL es un proyecto de código abierto.
Sí. UniRL es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.
UniRL está escrito principalmente en Python.
Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.
[](https://opensourceai.tech/project/tencent-hunyuan-unirl.html)
Medido a partir de los topics de GitHub comunes a ambos proyectos, ponderados por su rareza.