La implementación oficial de Optimización de Preferencias de Juego Autónomo (SPPO)
Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.
Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.
Gratis · sin tarjeta · cancela cuando quierasLa implementación oficial de Optimización de Preferencias de Juego Autónomo (SPPO)
SPPO tiene 590 estrellas en GitHub. Se ha bifurcado 48 veces. SPPO está escrito principalmente en Python. Se desarrolla activamente desde 2024. SPPO está disponible bajo la licencia Apache-2.0. Sus temas principales son: deep-learning, fine-tuning, large-language-models, rlhf.
La implementación oficial de Optimización de Preferencias de Juego Autónomo (SPPO)
SPPO es un proyecto de código abierto. Se distribuye bajo la licencia Apache-2.0.
Sí. SPPO es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.
SPPO está disponible bajo la licencia Apache-2.0.
SPPO está escrito principalmente en Python.
Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.
[](https://opensourceai.tech/project/uclaml-sppo.html)
Medido a partir de los topics de GitHub comunes a ambos proyectos, ponderados por su rareza.