[NeurIPS 2024] SimPO: Einfache Präferenzoptimierung mit einer referenzfreien Belohnung
Optimieren Sie die Präferenzen für KI-Modelle, ohne ein Referenzmodell zu benötigen, um deren Leistung bei verschiedenen Aufgaben zu verbessern.
Beanspruchen Sie die Seite: indexiert unabhangig vom Rang, in sechs Sprachen ubersetzt und mit Ihren eigenen Worten erganzt.
Erhalten Sie eine E-Mail-Benachrichtigung beim nächsten Release oder wenn es durchstartet.
Kostenlos · ohne Karte · jederzeit abbestellbar[NeurIPS 2024] SimPO: Einfache Präferenzoptimierung mit einer referenzfreien Belohnung
SimPO hat 956 Sterne auf GitHub. Es wurde 78-mal geforkt. SimPO ist hauptsächlich in Python geschrieben. Es wird seit 2024 aktiv entwickelt. SimPO ist unter der MIT-Lizenz verfügbar. Die Hauptthemen sind: alignment, large-language-models, preference-alignment, rlhf.
[NeurIPS 2024] SimPO: Einfache Präferenzoptimierung mit einer referenzfreien Belohnung
SimPO ist ein Open-Source-Projekt. Es wird unter der MIT-Lizenz veröffentlicht.
Ja. SimPO ist kostenlos und Open Source — Sie können es nutzen, anpassen und selbst hosten.
SimPO ist unter der MIT-Lizenz verfügbar.
SimPO ist hauptsächlich in Python geschrieben.
Fügen Sie dieses Live-Abzeichen zu Ihrem README hinzu — Ihre GitHub-Sterne und Verzeichnisrang, täglich aktualisiert.
[](https://olud.ai/project/princeton-nlp-simpo.html)
Ermittelt aus gemeinsamen GitHub-Topics beider Projekte, gewichtet nach ihrer Seltenheit.