Une enquête sur l'apprentissage par renforcement pour les grands modèles de raisonnement
Lisez une enquête sur l'utilisation de l'apprentissage par renforcement dans de grands modèles de raisonnement.
Revendiquez sa page : indexée quel que soit son rang, traduite en six langues, et enrichie de vos propres mots.
Recevez une alerte par e-mail à sa prochaine version ou quand il décolle — ne ratez plus rien.
Gratuit · sans carte · désinscription à tout momentUne enquête sur l'apprentissage par renforcement pour les grands modèles de raisonnement
Awesome-RL-for-LRMs compte 2.5k étoiles sur GitHub. Il a été forké 131 fois. Awesome-RL-for-LRMs est écrit principalement en TeX. Il est développé activement depuis 2025. Awesome-RL-for-LRMs est disponible sous licence MIT. Ses principaux thèmes sont : awesome-list, deepseek-r1, llm, lrm.
Une enquête sur l'apprentissage par renforcement pour les grands modèles de raisonnement
Awesome-RL-for-LRMs est un projet open source. Il est distribué sous licence MIT.
Oui. Awesome-RL-for-LRMs est gratuit et open source — vous pouvez l'utiliser, le modifier et l'héberger vous-même.
Awesome-RL-for-LRMs est disponible sous licence MIT.
Awesome-RL-for-LRMs est écrit principalement en TeX.
Ajoutez ce badge en direct à votre README — vos étoiles GitHub et votre classement dans le répertoire, actualisés quotidiennement.
[](https://opensourceai.tech/project/tsinghuac3i-awesome-rl-for-lrms.html)
Mesuré à partir des topics GitHub communs aux deux projets, pondérés par leur rareté.