[NeurIPS 2024] SimPO: Optimización de Preferencias Simple con una Recompensa Sin Referencia
Optimiza preferencias para modelos de IA sin necesidad de un modelo de referencia, mejorando su rendimiento en diversas tareas.
Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.
Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.
Gratis · sin tarjeta · cancela cuando quieras[NeurIPS 2024] SimPO: Optimización de Preferencias Simple con una Recompensa Sin Referencia
SimPO tiene 956 estrellas en GitHub. Se ha bifurcado 78 veces. SimPO está escrito principalmente en Python. Se desarrolla activamente desde 2024. SimPO está disponible bajo la licencia MIT. Sus temas principales son: alignment, large-language-models, preference-alignment, rlhf.
[NeurIPS 2024] SimPO: Optimización de Preferencias Simple con una Recompensa Sin Referencia
SimPO es un proyecto de código abierto. Se distribuye bajo la licencia MIT.
Sí. SimPO es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.
SimPO está disponible bajo la licencia MIT.
SimPO está escrito principalmente en Python.
Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.
[](https://opensourceai.tech/project/princeton-nlp-simpo.html)
Medido a partir de los topics de GitHub comunes a ambos proyectos, ponderados por su rareza.