Accueil Projets RLHF-Reward-Modeling
RLHF-Reward-Modeling

RLHF-Reward-Modeling

par RLHFlow · GitHub

Recettes pour entraîner un modèle de récompense pour RLHF.

Voir sur GitHub
En termes simples

Entraînez des modèles pour prédire les préférences des utilisateurs en fonction de leurs réponses aux invites.

⭐ Étoiles
🍴 Forks
🔥 Tendances
📜 Licence
Utilisation commerciale autorisée
📅 Créé
🔄 Dernier commit
🏷️ Catégorie
💻 Langue
🖥️ Auto-hébergeable
Probable
Vous maintenez ce projet ?

Revendiquez sa page : indexée quel que soit son rang, traduite en six langues, et enrichie de vos propres mots.

Revendiquer cette page →
RLHF-Reward-Modeling — GitHub preview card
📈 Historique des étoiles
1.54k1.53k
2026-07-202026-07-29
📈 Suivez RLHF-Reward-Modeling

Recevez une alerte par e-mail à sa prochaine version ou quand il décolle — ne ratez plus rien.

Gratuit · sans carte · désinscription à tout moment
Recevoir des alertes e-mail →
📄 À propos

Recettes pour entraîner un modèle de récompense pour RLHF.

RLHF-Reward-Modeling compte 1.5k étoiles sur GitHub. Il a été forké 110 fois. RLHF-Reward-Modeling est écrit principalement en Python. Il est développé activement depuis 2024. RLHF-Reward-Modeling est disponible sous licence Apache-2.0. Ses principaux thèmes sont : llama3, llm, reward-models, rlhf.

Frequently asked questions

Qu'est-ce que RLHF-Reward-Modeling ?

Recettes pour entraîner un modèle de récompense pour RLHF.

RLHF-Reward-Modeling est-il open source ?

RLHF-Reward-Modeling est un projet open source. Il est distribué sous licence Apache-2.0.

RLHF-Reward-Modeling est-il gratuit ?

Oui. RLHF-Reward-Modeling est gratuit et open source — vous pouvez l'utiliser, le modifier et l'héberger vous-même.

Sous quelle licence est RLHF-Reward-Modeling ?

RLHF-Reward-Modeling est disponible sous licence Apache-2.0.

Dans quel langage RLHF-Reward-Modeling est-il écrit ?

RLHF-Reward-Modeling est écrit principalement en Python.

🏅 Mainteneur de ce projet ?
olud.ai badge — RLHF-Reward-Modeling

Ajoutez ce badge en direct à votre README — vos étoiles GitHub et votre classement dans le répertoire, actualisés quotidiennement.

[![olud.ai](https://olud.ai/badge.php?tool=rlhflow-rlhf-reward-modeling)](https://olud.ai/project/rlhflow-rlhf-reward-modeling.html)
Plus d'options de badge →
🧬 Partage son ADN avec🧬 Voir la cartographie ADN →

Mesuré à partir des topics GitHub communs aux deux projets, pondérés par leur rareté.