Home Progetti LLM-RLHF-Tuning
LLM-RLHF-Tuning
Python

LLM-RLHF-Tuning

Tuning LLM con PEFT (SFT+RM+PPO+DPO con LoRA)

di Joyce94 · GitHub
Stelle
Fork
Creato
Ultimo commit
Categoria
Lingua
Probabile
Auto-ospitato
fine-tuninglanguage-modelllamaPythonAuto-ospitato
Visualizza su GitHub
In parole semplici

Allena modelli AI utilizzando tecniche di reinforcement learning con guida dettagliata sull'implementazione.

Mantieni questo progetto?

Rivendica la sua pagina: indicizzata qualunque sia il rango, tradotta in sei lingue e arricchita con le tue parole.

Rivendica questa pagina →
LLM-RLHF-Tuning — GitHub preview card
📈 Storia delle stelle
453452
2026-07-202026-08-31
📈 Segui LLM-RLHF-Tuning

Ricevi un avviso via email alla prossima release o quando decolla — non perderti nulla.

Gratis · senza carta · disdici quando vuoi
Ricevi avvisi via email →
📄 Informazioni

Tuning LLM con PEFT (SFT+RM+PPO+DPO con LoRA)

LLM-RLHF-Tuning ha 452 stelle su GitHub. È stato forkato 24 volte. LLM-RLHF-Tuning è scritto principalmente in Python. È in sviluppo attivo dal 2023. I suoi temi principali sono: fine-tuning, language-model, llama, llm.

Frequently asked questions

Che cos'è LLM-RLHF-Tuning?

Tuning LLM con PEFT (SFT+RM+PPO+DPO con LoRA)

LLM-RLHF-Tuning è open source?

LLM-RLHF-Tuning è un progetto open source.

LLM-RLHF-Tuning è gratuito?

Sì. LLM-RLHF-Tuning è gratuito e open source: puoi usarlo, modificarlo e ospitarlo autonomamente.

In quale linguaggio è scritto LLM-RLHF-Tuning?

LLM-RLHF-Tuning è scritto principalmente in Python.

🏅 Manutentore di questo progetto?
olud.ai badge — LLM-RLHF-Tuning

Aggiungi questo badge live al tuo README — le tue stelle GitHub e il ranking della directory, aggiornati quotidianamente.

[![olud.ai](https://olud.ai/badge.php?tool=joyce94-llm-rlhf-tuning)](https://olud.ai/project/joyce94-llm-rlhf-tuning.html)
Altre opzioni di badge →
🧬 Condivide il DNA con🧬 Vedi la mappa del DNA →

Misurato dai topic GitHub comuni a entrambi i progetti, ponderati per la loro rarita.