Un repo per l'addestramento distribuito di modelli linguistici con Reinforcement Learning tramite Feedback Umano (RLHF)
Affina modelli di linguaggio di grandi dimensioni utilizzando l'apprendimento per rinforzo sulla tua configurazione.
Rivendica la sua pagina: indicizzata qualunque sia il rango, tradotta in sei lingue e arricchita con le tue parole.
Ricevi un avviso via email alla prossima release o quando decolla — non perderti nulla.
Gratis · senza carta · disdici quando vuoiUn repo per l'addestramento distribuito di modelli linguistici con Reinforcement Learning tramite Feedback Umano (RLHF)
trlx ha 4.8k stelle su GitHub. È stato forkato 486 volte. trlx è scritto principalmente in Python. È in sviluppo attivo dal 2022. trlx è disponibile con licenza MIT. I suoi temi principali sono: machine-learning, pytorch, reinforcement-learning.
Un repo per l'addestramento distribuito di modelli linguistici con Reinforcement Learning tramite Feedback Umano (RLHF)
trlx è un progetto open source. È rilasciato con licenza MIT.
Sì. trlx è gratuito e open source: puoi usarlo, modificarlo e ospitarlo autonomamente.
trlx è disponibile con licenza MIT.
trlx è scritto principalmente in Python.
Aggiungi questo badge live al tuo README — le tue stelle GitHub e il ranking della directory, aggiornati quotidianamente.
[](https://olud.ai/project/carperai-trlx.html)