Ajuste de LLM con PEFT (SFT+RM+PPO+DPO con LoRA)
Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.
Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.
Gratis · sin tarjeta · cancela cuando quierasAjuste de LLM con PEFT (SFT+RM+PPO+DPO con LoRA)
LLM-RLHF-Tuning tiene 453 estrellas en GitHub. Se ha bifurcado 24 veces. LLM-RLHF-Tuning está escrito principalmente en Python. Se desarrolla activamente desde 2023. Sus temas principales son: fine-tuning, language-model, llama, llm.
Ajuste de LLM con PEFT (SFT+RM+PPO+DPO con LoRA)
LLM-RLHF-Tuning es un proyecto de código abierto.
Sí. LLM-RLHF-Tuning es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.
LLM-RLHF-Tuning está escrito principalmente en Python.
Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.
[](https://opensourceai.tech/project/joyce94-llm-rlhf-tuning.html)
Medido a partir de los topics de GitHub comunes a ambos proyectos, ponderados por su rareza.