Ein Repo für verteiltes Training von Sprachmodellen mit Reinforcement Learning über menschliches Feedback (RLHF)
Feinabstimmung großer Sprachmodelle mithilfe von Reinforcement Learning auf Ihrer eigenen Einrichtung.
Beanspruchen Sie die Seite: indexiert unabhangig vom Rang, in sechs Sprachen ubersetzt und mit Ihren eigenen Worten erganzt.
Erhalten Sie eine E-Mail-Benachrichtigung beim nächsten Release oder wenn es durchstartet.
Kostenlos · ohne Karte · jederzeit abbestellbarEin Repo für verteiltes Training von Sprachmodellen mit Reinforcement Learning über menschliches Feedback (RLHF)
trlx hat 4.8k Sterne auf GitHub. Es wurde 486-mal geforkt. trlx ist hauptsächlich in Python geschrieben. Es wird seit 2022 aktiv entwickelt. trlx ist unter der MIT-Lizenz verfügbar. Die Hauptthemen sind: machine-learning, pytorch, reinforcement-learning.
Ein Repo für verteiltes Training von Sprachmodellen mit Reinforcement Learning über menschliches Feedback (RLHF)
trlx ist ein Open-Source-Projekt. Es wird unter der MIT-Lizenz veröffentlicht.
Ja. trlx ist kostenlos und Open Source — Sie können es nutzen, anpassen und selbst hosten.
trlx ist unter der MIT-Lizenz verfügbar.
trlx ist hauptsächlich in Python geschrieben.
Fügen Sie dieses Live-Abzeichen zu Ihrem README hinzu — Ihre GitHub-Sterne und Verzeichnisrang, täglich aktualisiert.
[](https://olud.ai/project/carperai-trlx.html)