Startseite Projekte rlhf-book
rlhf-book

rlhf-book

von natolambert · GitHub

Lehrbuch über Verstärkungslernen aus menschlichem Feedback

Auf GitHub ansehen
In einfachen Worten

Lesen Sie einen umfassenden Leitfaden zur Verwendung von Reinforcement Learning mit menschlichem Feedback für Sprachmodelle.

⭐ Sterne
🍴 Forks
🔥 Trendend
📜 Lizenz
Lizenz nicht angegeben
📅 Erstellt
🔄 Letzter Commit
🏷️ Kategorie
💻 Sprache
Betreuen Sie dieses Projekt?

Beanspruchen Sie die Seite: indexiert unabhangig vom Rang, in sechs Sprachen ubersetzt und mit Ihren eigenen Worten erganzt.

Diese Seite beanspruchen →
rlhf-book — GitHub preview card
📈 Sternhistorie
2.2k2.1k
2026-07-072026-07-29
📈 rlhf-book verfolgen

Erhalten Sie eine E-Mail-Benachrichtigung beim nächsten Release oder wenn es durchstartet.

Kostenlos · ohne Karte · jederzeit abbestellbar
E-Mail-Alerts erhalten →
📄 Über

Lehrbuch über Verstärkungslernen aus menschlichem Feedback

rlhf-book hat 2.2k Sterne auf GitHub. Es wurde 236-mal geforkt. rlhf-book ist hauptsächlich in Python geschrieben. Es wird seit 2024 aktiv entwickelt. Die Hauptthemen sind: ai, alignment, rlhf.

Frequently asked questions

Was ist rlhf-book?

Lehrbuch über Verstärkungslernen aus menschlichem Feedback

Ist rlhf-book Open Source?

rlhf-book ist ein Open-Source-Projekt.

Ist rlhf-book kostenlos?

Ja. rlhf-book ist kostenlos und Open Source — Sie können es nutzen, anpassen und selbst hosten.

In welcher Sprache ist rlhf-book geschrieben?

rlhf-book ist hauptsächlich in Python geschrieben.

🏅 Wartender dieses Projekts?
OpenSourceAI badge — rlhf-book

Fügen Sie dieses Live-Abzeichen zu Ihrem README hinzu — Ihre GitHub-Sterne und Verzeichnisrang, täglich aktualisiert.

[![OpenSourceAI](https://opensourceai.tech/badge.php?tool=natolambert-rlhf-book)](https://opensourceai.tech/project/natolambert-rlhf-book.html)
Weitere Abzeichenoptionen →
🧬 Teilt DNA mit🧬 DNA-Karte ansehen →

Ermittelt aus gemeinsamen GitHub-Topics beider Projekte, gewichtet nach ihrer Seltenheit.