slime es un marco de post-entrenamiento LLM para escalado RL.
Entrena modelos de lenguaje de manera eficiente y genera datos de entrenamiento personalizados para aprendizaje por refuerzo.
Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.
Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.
Gratis · sin tarjeta · cancela cuando quierasslime es un marco de post-entrenamiento LLM para escalado RL.
slime tiene 7.7k estrellas en GitHub. Se ha bifurcado 1.1k veces. slime está escrito principalmente en Python. Se desarrolla activamente desde 2025. slime está disponible bajo la licencia Apache-2.0.
slime es un marco de post-entrenamiento LLM para escalado RL.
slime es un proyecto de código abierto. Se distribuye bajo la licencia Apache-2.0.
Sí. slime es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.
slime está disponible bajo la licencia Apache-2.0.
slime está escrito principalmente en Python.
Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.
[](https://olud.ai/project/thudm-slime.html)