Ajustement de LLM avec PEFT (SFT+RM+PPO+DPO avec LoRA)
Revendiquez sa page : indexée quel que soit son rang, traduite en six langues, et enrichie de vos propres mots.
Recevez une alerte par e-mail à sa prochaine version ou quand il décolle — ne ratez plus rien.
Gratuit · sans carte · désinscription à tout momentAjustement de LLM avec PEFT (SFT+RM+PPO+DPO avec LoRA)
LLM-RLHF-Tuning compte 453 étoiles sur GitHub. Il a été forké 24 fois. LLM-RLHF-Tuning est écrit principalement en Python. Il est développé activement depuis 2023. Ses principaux thèmes sont : fine-tuning, language-model, llama, llm.
Ajustement de LLM avec PEFT (SFT+RM+PPO+DPO avec LoRA)
LLM-RLHF-Tuning est un projet open source.
Oui. LLM-RLHF-Tuning est gratuit et open source — vous pouvez l'utiliser, le modifier et l'héberger vous-même.
LLM-RLHF-Tuning est écrit principalement en Python.
Ajoutez ce badge en direct à votre README — vos étoiles GitHub et votre classement dans le répertoire, actualisés quotidiennement.
[](https://opensourceai.tech/project/joyce94-llm-rlhf-tuning.html)
Mesuré à partir des topics GitHub communs aux deux projets, pondérés par leur rareté.