Accueil Projets RLHF-Reward-Modeling
RLHF-Reward-Modeling
Python

RLHF-Reward-Modeling

Recettes pour entraîner un modèle de récompense pour RLHF.

par RLHFlow · GitHub
Étoiles
Forks
Licence
Créé
Dernier commit
Catégorie
Langue
Probable
Auto-hébergeable
llama3llmreward-modelsApache-2.0PythonAuto-hébergeable
Voir sur GitHub
En termes simples

Entraînez des modèles pour prédire les préférences des utilisateurs en fonction de leurs réponses aux invites.

Vous maintenez ce projet ?

Revendiquez sa page : indexée quel que soit son rang, traduite en six langues, et enrichie de vos propres mots.

Revendiquer cette page →
RLHF-Reward-Modeling — GitHub preview card
📈 Historique des étoiles
1.54k1.53k
2026-07-202026-08-31
📈 Suivez RLHF-Reward-Modeling

Recevez une alerte par e-mail à sa prochaine version ou quand il décolle — ne ratez plus rien.

Gratuit · sans carte · désinscription à tout moment
Recevoir des alertes e-mail →
📄 À propos

Recettes pour entraîner un modèle de récompense pour RLHF.

RLHF-Reward-Modeling compte 1.5k étoiles sur GitHub. Il a été forké 110 fois. RLHF-Reward-Modeling est écrit principalement en Python. Il est développé activement depuis 2024. RLHF-Reward-Modeling est disponible sous licence Apache-2.0. Ses principaux thèmes sont : llama3, llm, reward-models, rlhf.

Frequently asked questions

Qu'est-ce que RLHF-Reward-Modeling ?

Recettes pour entraîner un modèle de récompense pour RLHF.

RLHF-Reward-Modeling est-il open source ?

RLHF-Reward-Modeling est un projet open source. Il est distribué sous licence Apache-2.0.

RLHF-Reward-Modeling est-il gratuit ?

Oui. RLHF-Reward-Modeling est gratuit et open source — vous pouvez l'utiliser, le modifier et l'héberger vous-même.

Sous quelle licence est RLHF-Reward-Modeling ?

RLHF-Reward-Modeling est disponible sous licence Apache-2.0.

Dans quel langage RLHF-Reward-Modeling est-il écrit ?

RLHF-Reward-Modeling est écrit principalement en Python.

🏅 Mainteneur de ce projet ?
olud.ai badge — RLHF-Reward-Modeling

Ajoutez ce badge en direct à votre README — vos étoiles GitHub et votre classement dans le répertoire, actualisés quotidiennement.

[![olud.ai](https://olud.ai/badge.php?tool=rlhflow-rlhf-reward-modeling)](https://olud.ai/project/rlhflow-rlhf-reward-modeling.html)
Plus d'options de badge →
🧬 Partage son ADN avec🧬 Voir la cartographie ADN →

Mesuré à partir des topics GitHub communs aux deux projets, pondérés par leur rareté.