Um repositório para treinamento distribuído de modelos de linguagem com Aprendizado por Reforço via Feedback Humano (RLHF).
Ajuste grandes modelos de linguagem usando aprendizado por reforço na sua própria configuração.
Reivindique a sua pagina: indexada seja qual for a posicao, traduzida em seis linguas e enriquecida com as suas palavras.
Receba um alerta por e-mail no próximo lançamento ou quando começar a bombar.
Grátis · sem cartão · cancele quando quiserUm repositório para treinamento distribuído de modelos de linguagem com Aprendizado por Reforço via Feedback Humano (RLHF).
trlx tem 4.8k estrelas no GitHub. Foi bifurcado 486 vezes. trlx é escrito principalmente em Python. Está em desenvolvimento ativo desde 2022. trlx está disponível sob a licença MIT. Os seus principais temas são: machine-learning, pytorch, reinforcement-learning.
Um repositório para treinamento distribuído de modelos de linguagem com Aprendizado por Reforço via Feedback Humano (RLHF).
trlx é um projeto de código aberto. É distribuído sob a licença MIT.
Sim. trlx é gratuito e de código aberto — você pode usá-lo, modificá-lo e hospedá-lo por conta própria.
trlx está disponível sob a licença MIT.
trlx é escrito principalmente em Python.
Adicione este badge ao vivo ao seu README — suas estrelas do GitHub e classificação no diretório, atualizadas diariamente.
[](https://olud.ai/project/carperai-trlx.html)