Un repositorio para el entrenamiento distribuido de modelos de lenguaje con Aprendizaje por Refuerzo a través de Retroalimentación Humana (RLHF).
Ajusta modelos de lenguaje grandes utilizando aprendizaje por refuerzo en tu propia configuración.
Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.
Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.
Gratis · sin tarjeta · cancela cuando quierasUn repositorio para el entrenamiento distribuido de modelos de lenguaje con Aprendizaje por Refuerzo a través de Retroalimentación Humana (RLHF).
trlx tiene 4.8k estrellas en GitHub. Se ha bifurcado 486 veces. trlx está escrito principalmente en Python. Se desarrolla activamente desde 2022. trlx está disponible bajo la licencia MIT. Sus temas principales son: machine-learning, pytorch, reinforcement-learning.
Un repositorio para el entrenamiento distribuido de modelos de lenguaje con Aprendizaje por Refuerzo a través de Retroalimentación Humana (RLHF).
trlx es un proyecto de código abierto. Se distribuye bajo la licencia MIT.
Sí. trlx es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.
trlx está disponible bajo la licencia MIT.
trlx está escrito principalmente en Python.
Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.
[](https://olud.ai/project/carperai-trlx.html)