Solución de RL escalable para razonamiento avanzado de modelos de lenguaje
Avanza las habilidades de razonamiento de los modelos de lenguaje utilizando un enfoque escalable de aprendizaje por refuerzo.
Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.
Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.
Gratis · sin tarjeta · cancela cuando quierasSolución de RL escalable para razonamiento avanzado de modelos de lenguaje
PRIME tiene 1.9k estrellas en GitHub. Se ha bifurcado 116 veces. PRIME está escrito principalmente en Python. Se desarrolla activamente desde 2024. PRIME está disponible bajo la licencia Apache-2.0. Sus temas principales son: llm, reasoning, rl.
Solución de RL escalable para razonamiento avanzado de modelos de lenguaje
PRIME es un proyecto de código abierto. Se distribuye bajo la licencia Apache-2.0.
Sí. PRIME es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.
PRIME está disponible bajo la licencia Apache-2.0.
PRIME está escrito principalmente en Python.
Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.
[](https://opensourceai.tech/project/prime-rl-prime.html)
Medido a partir de los topics de GitHub comunes a ambos proyectos, ponderados por su rareza.