TRL est la bibliothèque de Hugging Face pour le post-entraînement et l'alignement des modèles de langage avec un fine-tuning supervisé, DPO et des méthodes d'apprentissage par renforcement comme PPO.
| Catégorie | Ajustement fin |
| Type | Bibliothèque RLHF / d'alignement |
| Licence | Apache-2.0 |
| S'exécute localement | Oui |
| Construit avec | Python |
| Niveau de compétence | Avancé |
| Meilleur pour | Entraînement RLHF, DPO et d'alignement |
Autres outils d'ajustement open-source à comparer :
UnslothAjustez les LLM 2x plus vite sur un GPU
AxolotlAjustement basé sur la configuration pour de nombreux modèles
LLaMA-FactoryAjustez 100+ modèles avec une interface utilisateur
PEFTLoRA et amis de Hugging Face
TorchtuneRecettes post-formation hackables, natives de PyTorch
Llama CookbookRecettes officielles pour affiner Llama
ms-swiftAffinez plus de 500 LLMs et VLMsTRL est gratuit et open-source (licence Apache-2.0), vous pouvez donc l'utiliser, l'héberger vous-même et le modifier sans frais.
Oui. TRL est conçu pour fonctionner sur votre propre machine ou serveur, en gardant vos données privées.
Les alternatives open-source populaires incluent Unsloth, Axolotl, LLaMA-Factory. Consultez les comparaisons ci-dessus pour choisir.
Parcourez le répertoire complet des outils, modèles et projets d'IA open-source — mis à jour quotidiennement.
Parcourez tous les outils →