Condividiamo sia intuizioni pratiche che conoscenze teoriche sulla valutazione LLM che abbiamo raccolto mentre gestivamo l'Open LLM Leaderboard e progettavamo lighteval!
Impara come valutare efficacemente i modelli di linguaggio di grandi dimensioni con suggerimenti pratici e indicazioni per i tuoi compiti specifici.
Rivendica la sua pagina: indicizzata qualunque sia il rango, tradotta in sei lingue e arricchita con le tue parole.
Ricevi un avviso via email alla prossima release o quando decolla — non perderti nulla.
Gratis · senza carta · disdici quando vuoiCondividiamo sia intuizioni pratiche che conoscenze teoriche sulla valutazione LLM che abbiamo raccolto mentre gestivamo l'Open LLM Leaderboard e progettavamo lighteval!
evaluation-guidebook ha 2.1k stelle su GitHub. È stato forkato 124 volte. evaluation-guidebook è scritto principalmente in Jupyter Notebook. È in sviluppo attivo dal 2024. I suoi temi principali sono: evaluation, evaluation-metrics, guidebook, large-language-models.
Condividiamo sia intuizioni pratiche che conoscenze teoriche sulla valutazione LLM che abbiamo raccolto mentre gestivamo l'Open LLM Leaderboard e progettavamo lighteval!
evaluation-guidebook è un progetto open source.
Sì. evaluation-guidebook è gratuito e open source: puoi usarlo, modificarlo e ospitarlo autonomamente.
evaluation-guidebook è scritto principalmente in Jupyter Notebook.
Aggiungi questo badge live al tuo README — le tue stelle GitHub e il ranking della directory, aggiornati quotidianamente.
[](https://opensourceai.tech/project/huggingface-evaluation-guidebook.html)