[NeurIPS 2024] SimPO : Optimisation simple des préférences avec une récompense sans référence
Optimisez les préférences pour les modèles IA sans avoir besoin d'un modèle de référence, améliorant ainsi leur performance sur diverses tâches.
Revendiquez sa page : indexée quel que soit son rang, traduite en six langues, et enrichie de vos propres mots.
Recevez une alerte par e-mail à sa prochaine version ou quand il décolle — ne ratez plus rien.
Gratuit · sans carte · désinscription à tout moment[NeurIPS 2024] SimPO : Optimisation simple des préférences avec une récompense sans référence
SimPO compte 956 étoiles sur GitHub. Il a été forké 78 fois. SimPO est écrit principalement en Python. Il est développé activement depuis 2024. SimPO est disponible sous licence MIT. Ses principaux thèmes sont : alignment, large-language-models, preference-alignment, rlhf.
[NeurIPS 2024] SimPO : Optimisation simple des préférences avec une récompense sans référence
SimPO est un projet open source. Il est distribué sous licence MIT.
Oui. SimPO est gratuit et open source — vous pouvez l'utiliser, le modifier et l'héberger vous-même.
SimPO est disponible sous licence MIT.
SimPO est écrit principalement en Python.
Ajoutez ce badge en direct à votre README — vos étoiles GitHub et votre classement dans le répertoire, actualisés quotidiennement.
[](https://olud.ai/project/princeton-nlp-simpo.html)
Mesuré à partir des topics GitHub communs aux deux projets, pondérés par leur rareté.