Accueil Projets awesome-RLHF
awesome-RLHF
deep-learning

awesome-RLHF

Une liste sélectionnée de ressources d'apprentissage par renforcement avec retour humain (continuellement mise à jour)

par opendilab · GitHub
Étoiles
Forks
Licence
Créé
Dernier commit
Catégorie
deep-learningdeep-reinforcement-learninghuman-feedbackApache-2.0
Voir sur GitHub
En termes simples

Parcourez une collection d'articles de recherche sur l'utilisation des retours humains pour améliorer les modèles d'apprentissage par renforcement.

Vous maintenez ce projet ?

Revendiquez sa page : indexée quel que soit son rang, traduite en six langues, et enrichie de vos propres mots.

Revendiquer cette page →
awesome-RLHF — GitHub preview card
📈 Historique des étoiles
4.42k4.41k
2026-07-072026-08-31
📈 Suivez awesome-RLHF

Recevez une alerte par e-mail à sa prochaine version ou quand il décolle — ne ratez plus rien.

Gratuit · sans carte · désinscription à tout moment
Recevoir des alertes e-mail →
📄 À propos

Une liste sélectionnée de ressources d'apprentissage par renforcement avec retour humain (continuellement mise à jour)

awesome-RLHF compte 4.4k étoiles sur GitHub. Il a été forké 259 fois. Il est développé activement depuis 2023. awesome-RLHF est disponible sous licence Apache-2.0. Ses principaux thèmes sont : deep-learning, deep-reinforcement-learning, human-feedback, large-language-models.

Frequently asked questions

Qu'est-ce que awesome-RLHF ?

Une liste sélectionnée de ressources d'apprentissage par renforcement avec retour humain (continuellement mise à jour)

awesome-RLHF est-il open source ?

awesome-RLHF est un projet open source. Il est distribué sous licence Apache-2.0.

awesome-RLHF est-il gratuit ?

Oui. awesome-RLHF est gratuit et open source — vous pouvez l'utiliser, le modifier et l'héberger vous-même.

Sous quelle licence est awesome-RLHF ?

awesome-RLHF est disponible sous licence Apache-2.0.

🏅 Mainteneur de ce projet ?
olud.ai badge — awesome-RLHF

Ajoutez ce badge en direct à votre README — vos étoiles GitHub et votre classement dans le répertoire, actualisés quotidiennement.

[![olud.ai](https://olud.ai/badge.php?tool=opendilab-awesome-rlhf)](https://olud.ai/project/opendilab-awesome-rlhf.html)
Plus d'options de badge →
🧬 Partage son ADN avec🧬 Voir la cartographie ADN →
hands-on-rl
Cours gratuit qui vous emmène de zéro à PRO en apprentissage par renforcement 🦸🏻‍🦸🏽
1.6k · deep-reinforcement-learning
partagedeep-reinforcement-learningreinforcement-learning
ABC-GRPO
Code pour le clipping de frontière adaptatif GRPO. arxiv.org/pdf/2601.03895
442 · grpo
partagerlhfreinforcement-learning
drl-zh
Apprentissage par renforcement profond : De zéro à héros !
2.3k · deep-learning
partagedeep-reinforcement-learningreinforcement-learning
reward-learning-rl
[RSS 2019] Apprentissage par renforcement robotique de bout en bout sans ingénierie de récompen…
374 · deep-learning
partagedeep-reinforcement-learningreinforcement-learning
MARL-Algorithms
Implémentations de IQL, QMIX, VDN, COMA, QTRAN, MAVEN, CommNet, DyMA-CL, et G2ANet sur SMAC, le…
1.8k · deep-reinforcement-learning
partagedeep-reinforcement-learningreinforcement-learning
DexterousHands
Ceci est une bibliothèque qui fournit des tâches de manipulation de mains duales habiles via Is…
1.1k · deep-reinforcement-learning
partagedeep-reinforcement-learningreinforcement-learning
gps
Recherche de Politique Guidée
600 · deep-learning
partagedeep-reinforcement-learningreinforcement-learning
neural-symbolic-machines
Les Machines Symboliques Neurales sont un cadre pour intégrer des réseaux de neurones et des re…
385 · deep-learning
partagedeep-reinforcement-learningreinforcement-learning
deep-rl-class
Ce repo contient le cours de Deep Reinforcement Learning de Hugging Face.
5k · deep-learning
partagedeep-reinforcement-learningreinforcement-learning
awesome-deep-rl
Une liste soigneusement sélectionnée de ressources incroyables en apprentissage par renforcemen…
896 · awesome-list
partagedeep-reinforcement-learningreinforcement-learning

Mesuré à partir des topics GitHub communs aux deux projets, pondérés par leur rareté.