Ajuste de LLM com PEFT (SFT+RM+PPO+DPO com LoRA)
Reivindique a sua pagina: indexada seja qual for a posicao, traduzida em seis linguas e enriquecida com as suas palavras.
Receba um alerta por e-mail no próximo lançamento ou quando começar a bombar.
Grátis · sem cartão · cancele quando quiserAjuste de LLM com PEFT (SFT+RM+PPO+DPO com LoRA)
LLM-RLHF-Tuning tem 453 estrelas no GitHub. Foi bifurcado 24 vezes. LLM-RLHF-Tuning é escrito principalmente em Python. Está em desenvolvimento ativo desde 2023. Os seus principais temas são: fine-tuning, language-model, llama, llm.
Ajuste de LLM com PEFT (SFT+RM+PPO+DPO com LoRA)
LLM-RLHF-Tuning é um projeto de código aberto.
Sim. LLM-RLHF-Tuning é gratuito e de código aberto — você pode usá-lo, modificá-lo e hospedá-lo por conta própria.
LLM-RLHF-Tuning é escrito principalmente em Python.
Adicione este badge ao vivo ao seu README — suas estrelas do GitHub e classificação no diretório, atualizadas diariamente.
[](https://opensourceai.tech/project/joyce94-llm-rlhf-tuning.html)
Medido a partir dos topics do GitHub comuns aos dois projetos, ponderados pela sua raridade.