[NeurIPS 2024] SimPO: Ottimizzazione Semplice delle Preferenze con una Ricompensa Senza Riferimento
Ottimizza le preferenze per i modelli AI senza necessità di un modello di riferimento, migliorando le loro prestazioni su vari compiti.
Rivendica la sua pagina: indicizzata qualunque sia il rango, tradotta in sei lingue e arricchita con le tue parole.
Ricevi un avviso via email alla prossima release o quando decolla — non perderti nulla.
Gratis · senza carta · disdici quando vuoi[NeurIPS 2024] SimPO: Ottimizzazione Semplice delle Preferenze con una Ricompensa Senza Riferimento
SimPO ha 956 stelle su GitHub. È stato forkato 78 volte. SimPO è scritto principalmente in Python. È in sviluppo attivo dal 2024. SimPO è disponibile con licenza MIT. I suoi temi principali sono: alignment, large-language-models, preference-alignment, rlhf.
[NeurIPS 2024] SimPO: Ottimizzazione Semplice delle Preferenze con una Ricompensa Senza Riferimento
SimPO è un progetto open source. È rilasciato con licenza MIT.
Sì. SimPO è gratuito e open source: puoi usarlo, modificarlo e ospitarlo autonomamente.
SimPO è disponibile con licenza MIT.
SimPO è scritto principalmente in Python.
Aggiungi questo badge live al tuo README — le tue stelle GitHub e il ranking della directory, aggiornati quotidianamente.
[](https://opensourceai.tech/project/princeton-nlp-simpo.html)
Misurato dai topic GitHub comuni a entrambi i progetti, ponderati per la loro rarita.