Inicio Proyectos RLHF-Reward-Modeling
RLHF-Reward-Modeling

RLHF-Reward-Modeling

por RLHFlow · GitHub

Recetas para entrenar un modelo de recompensa para RLHF.

Ver en GitHub
En palabras simples

Entrene modelos para predecir preferencias de los usuarios basándose en sus respuestas a indicaciones.

⭐ Estrellas
🍴 Ramas
🔥 Tendencias
📜 Licencia
Uso comercial permitido
📅 Creado
🔄 Último commit
🏷️ Categoría
💻 Lenguaje
🖥️ Autoalojable
Probable
¿Mantienes este proyecto?

Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.

Reivindicar esta pagina →
RLHF-Reward-Modeling — GitHub preview card
📈 Historial de estrellas
1.54k1.53k
2026-07-202026-07-29
📈 Sigue RLHF-Reward-Modeling

Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.

Gratis · sin tarjeta · cancela cuando quieras
Recibir alertas por email →
📄 Acerca de

Recetas para entrenar un modelo de recompensa para RLHF.

RLHF-Reward-Modeling tiene 1.5k estrellas en GitHub. Se ha bifurcado 110 veces. RLHF-Reward-Modeling está escrito principalmente en Python. Se desarrolla activamente desde 2024. RLHF-Reward-Modeling está disponible bajo la licencia Apache-2.0. Sus temas principales son: llama3, llm, reward-models, rlhf.

Frequently asked questions

¿Qué es RLHF-Reward-Modeling?

Recetas para entrenar un modelo de recompensa para RLHF.

¿RLHF-Reward-Modeling es de código abierto?

RLHF-Reward-Modeling es un proyecto de código abierto. Se distribuye bajo la licencia Apache-2.0.

¿RLHF-Reward-Modeling es gratis?

Sí. RLHF-Reward-Modeling es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.

¿Bajo qué licencia está RLHF-Reward-Modeling?

RLHF-Reward-Modeling está disponible bajo la licencia Apache-2.0.

¿En qué lenguaje está escrito RLHF-Reward-Modeling?

RLHF-Reward-Modeling está escrito principalmente en Python.

🏅 ¿Mantenedor de este proyecto?
OpenSourceAI badge — RLHF-Reward-Modeling

Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.

[![OpenSourceAI](https://opensourceai.tech/badge.php?tool=rlhflow-rlhf-reward-modeling)](https://opensourceai.tech/project/rlhflow-rlhf-reward-modeling.html)
Más opciones de distintivos →
🧬 Comparte ADN con🧬 Ver el mapa de ADN →

Medido a partir de los topics de GitHub comunes a ambos proyectos, ponderados por su rareza.