slime è un framework post-addestramento LLM per il scaling RL.
Addestra modelli di linguaggio in modo efficiente e genera dati di addestramento personalizzati per l'apprendimento per rinforzo.
Rivendica la sua pagina: indicizzata qualunque sia il rango, tradotta in sei lingue e arricchita con le tue parole.
Ricevi un avviso via email alla prossima release o quando decolla — non perderti nulla.
Gratis · senza carta · disdici quando vuoislime è un framework post-addestramento LLM per il scaling RL.
slime ha 7.7k stelle su GitHub. È stato forkato 1.1k volte. slime è scritto principalmente in Python. È in sviluppo attivo dal 2025. slime è disponibile con licenza Apache-2.0.
slime è un framework post-addestramento LLM per il scaling RL.
slime è un progetto open source. È rilasciato con licenza Apache-2.0.
Sì. slime è gratuito e open source: puoi usarlo, modificarlo e ospitarlo autonomamente.
slime è disponibile con licenza Apache-2.0.
slime è scritto principalmente in Python.
Aggiungi questo badge live al tuo README — le tue stelle GitHub e il ranking della directory, aggiornati quotidianamente.
[](https://olud.ai/project/thudm-slime.html)