Un dépôt pour l'entraînement distribué de modèles linguistiques avec apprentissage par renforcement via retour humain (RLHF).
Affinez de grands modèles de langage en utilisant l'apprentissage par renforcement sur votre propre configuration.
Revendiquez sa page : indexée quel que soit son rang, traduite en six langues, et enrichie de vos propres mots.
Recevez une alerte par e-mail à sa prochaine version ou quand il décolle — ne ratez plus rien.
Gratuit · sans carte · désinscription à tout momentUn dépôt pour l'entraînement distribué de modèles linguistiques avec apprentissage par renforcement via retour humain (RLHF).
trlx compte 4.8k étoiles sur GitHub. Il a été forké 486 fois. trlx est écrit principalement en Python. Il est développé activement depuis 2022. trlx est disponible sous licence MIT. Ses principaux thèmes sont : machine-learning, pytorch, reinforcement-learning.
Un dépôt pour l'entraînement distribué de modèles linguistiques avec apprentissage par renforcement via retour humain (RLHF).
trlx est un projet open source. Il est distribué sous licence MIT.
Oui. trlx est gratuit et open source — vous pouvez l'utiliser, le modifier et l'héberger vous-même.
trlx est disponible sous licence MIT.
trlx est écrit principalement en Python.
Ajoutez ce badge en direct à votre README — vos étoiles GitHub et votre classement dans le répertoire, actualisés quotidiennement.
[](https://olud.ai/project/carperai-trlx.html)