Evals è un framework per valutare LLM e sistemi LLM, e un registro open-source di benchmark.
Valuta e testa modelli di linguaggio di grandi dimensioni con benchmark esistenti o crea i tuoi test personalizzati.
pip install evals
Estratti dal README del progetto su GitHub. I diritti d'autore e le licenze rimangono con i rispettivi autori.
Rivendica la sua pagina: indicizzata qualunque sia il rango, tradotta in sei lingue e arricchita con le tue parole.
Ricevi un avviso via email alla prossima release o quando decolla — non perderti nulla.
Gratis · senza carta · disdici quando vuoiEvals è un framework per valutare LLM e sistemi LLM, e un registro open-source di benchmark.
evals ha 19.3k stelle su GitHub. È stato forkato 3.1k volte. evals è scritto principalmente in Python. È in sviluppo attivo dal 2023.
Evals è un framework per valutare LLM e sistemi LLM, e un registro open-source di benchmark.
evals è un progetto open source.
Sì. evals è gratuito e open source: puoi usarlo, modificarlo e ospitarlo autonomamente.
evals è scritto principalmente in Python.
Aggiungi questo badge live al tuo README — le tue stelle GitHub e il ranking della directory, aggiornati quotidianamente.
[](https://olud.ai/project/openai-evals.html)