TRL é a biblioteca da Hugging Face para pós-treinamento e alinhamento de modelos de linguagem com ajuste fino supervisionado, DPO e métodos de aprendizado por reforço como PPO.
| Categoria | Ajuste fino |
| Tipo | Biblioteca RLHF / alinhamento |
| Licença | Apache-2.0 |
| Executa localmente | Sim |
| Construído com | Python |
| Nível de habilidade | Avançado |
| Melhor para | Treinamento RLHF, DPO e alinhamento |
Outras ferramentas de ajuste fino de código aberto que valem a pena comparar:
UnslothAjuste fino de LLMs 2x mais rápido em uma GPU
AxolotlAjuste baseado em configuração para muitos modelos
LLaMA-FactoryAjuste fino de 100+ modelos com uma UI
PEFTLoRA e amigos do Hugging Face
TorchtuneReceitas hackeáveis de pós-treinamento nativas do PyTorch
Llama CookbookReceitas oficiais para ajustar Llama
ms-swiftAjuste 500+ LLMs e VLMsTRL é gratuito e de código aberto (licença Apache-2.0), então você pode usá-lo, hospedá-lo e modificá-lo sem custo.
Sim. O TRL é projetado para ser executado em sua própria máquina ou servidor, mantendo seus dados privados.
Alternativas populares de código aberto incluem Unsloth, Axolotl, LLaMA-Factory. Veja as comparações acima para escolher.
Navegue pelo diretório completo de ferramentas, modelos e projetos de IA de código aberto — atualizado diariamente.
Navegue por todas as ferramentas →