Una encuesta sobre el aprendizaje por refuerzo para modelos de razonamiento grandes.
Lee una encuesta sobre el uso del aprendizaje por refuerzo en grandes modelos de razonamiento.
Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.
Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.
Gratis · sin tarjeta · cancela cuando quierasUna encuesta sobre el aprendizaje por refuerzo para modelos de razonamiento grandes.
Awesome-RL-for-LRMs tiene 2.5k estrellas en GitHub. Se ha bifurcado 131 veces. Awesome-RL-for-LRMs está escrito principalmente en TeX. Se desarrolla activamente desde 2025. Awesome-RL-for-LRMs está disponible bajo la licencia MIT. Sus temas principales son: awesome-list, deepseek-r1, llm, lrm.
Una encuesta sobre el aprendizaje por refuerzo para modelos de razonamiento grandes.
Awesome-RL-for-LRMs es un proyecto de código abierto. Se distribuye bajo la licencia MIT.
Sí. Awesome-RL-for-LRMs es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.
Awesome-RL-for-LRMs está disponible bajo la licencia MIT.
Awesome-RL-for-LRMs está escrito principalmente en TeX.
Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.
[](https://olud.ai/project/tsinghuac3i-awesome-rl-for-lrms.html)
Medido a partir de los topics de GitHub comunes a ambos proyectos, ponderados por su rareza.