Lehrbuch über Verstärkungslernen aus menschlichem Feedback
Lesen Sie einen umfassenden Leitfaden zur Verwendung von Reinforcement Learning mit menschlichem Feedback für Sprachmodelle.
Beanspruchen Sie die Seite: indexiert unabhangig vom Rang, in sechs Sprachen ubersetzt und mit Ihren eigenen Worten erganzt.
Erhalten Sie eine E-Mail-Benachrichtigung beim nächsten Release oder wenn es durchstartet.
Kostenlos · ohne Karte · jederzeit abbestellbarLehrbuch über Verstärkungslernen aus menschlichem Feedback
rlhf-book hat 2.2k Sterne auf GitHub. Es wurde 236-mal geforkt. rlhf-book ist hauptsächlich in Python geschrieben. Es wird seit 2024 aktiv entwickelt. Die Hauptthemen sind: ai, alignment, rlhf.
Lehrbuch über Verstärkungslernen aus menschlichem Feedback
rlhf-book ist ein Open-Source-Projekt.
Ja. rlhf-book ist kostenlos und Open Source — Sie können es nutzen, anpassen und selbst hosten.
rlhf-book ist hauptsächlich in Python geschrieben.
Fügen Sie dieses Live-Abzeichen zu Ihrem README hinzu — Ihre GitHub-Sterne und Verzeichnisrang, täglich aktualisiert.
[](https://opensourceai.tech/project/natolambert-rlhf-book.html)
Ermittelt aus gemeinsamen GitHub-Topics beider Projekte, gewichtet nach ihrer Seltenheit.