Home Progetti RLHF-Reward-Modeling
RLHF-Reward-Modeling

RLHF-Reward-Modeling

di RLHFlow · GitHub

Ricette per addestrare modelli di ricompensa per RLHF.

Visualizza su GitHub
In parole semplici

Allena modelli per prevedere le preferenze degli utenti in base alle loro risposte a sollecitazioni.

⭐ Stelle
🍴 Fork
🔥 Tendenze
📜 Licenza
Uso commerciale consentito
📅 Creato
🔄 Ultimo commit
🏷️ Categoria
💻 Lingua
🖥️ Auto-ospitato
Probabile
Mantieni questo progetto?

Rivendica la sua pagina: indicizzata qualunque sia il rango, tradotta in sei lingue e arricchita con le tue parole.

Rivendica questa pagina →
RLHF-Reward-Modeling — GitHub preview card
📈 Storia delle stelle
1.54k1.53k
2026-07-202026-07-29
📈 Segui RLHF-Reward-Modeling

Ricevi un avviso via email alla prossima release o quando decolla — non perderti nulla.

Gratis · senza carta · disdici quando vuoi
Ricevi avvisi via email →
📄 Informazioni

Ricette per addestrare modelli di ricompensa per RLHF.

RLHF-Reward-Modeling ha 1.5k stelle su GitHub. È stato forkato 110 volte. RLHF-Reward-Modeling è scritto principalmente in Python. È in sviluppo attivo dal 2024. RLHF-Reward-Modeling è disponibile con licenza Apache-2.0. I suoi temi principali sono: llama3, llm, reward-models, rlhf.

Frequently asked questions

Che cos'è RLHF-Reward-Modeling?

Ricette per addestrare modelli di ricompensa per RLHF.

RLHF-Reward-Modeling è open source?

RLHF-Reward-Modeling è un progetto open source. È rilasciato con licenza Apache-2.0.

RLHF-Reward-Modeling è gratuito?

Sì. RLHF-Reward-Modeling è gratuito e open source: puoi usarlo, modificarlo e ospitarlo autonomamente.

Con quale licenza è RLHF-Reward-Modeling?

RLHF-Reward-Modeling è disponibile con licenza Apache-2.0.

In quale linguaggio è scritto RLHF-Reward-Modeling?

RLHF-Reward-Modeling è scritto principalmente in Python.

🏅 Manutentore di questo progetto?
olud.ai badge — RLHF-Reward-Modeling

Aggiungi questo badge live al tuo README — le tue stelle GitHub e il ranking della directory, aggiornati quotidianamente.

[![olud.ai](https://olud.ai/badge.php?tool=rlhflow-rlhf-reward-modeling)](https://olud.ai/project/rlhflow-rlhf-reward-modeling.html)
Altre opzioni di badge →
🧬 Condivide il DNA con🧬 Vedi la mappa del DNA →

Misurato dai topic GitHub comuni a entrambi i progetti, ponderati per la loro rarita.