Evals est un cadre pour évaluer les LLMs et les systèmes LLM, et un registre open-source de benchmarks.
Évaluez et testez des modèles de langage de grande taille avec des benchmarks existants ou créez vos propres tests personnalisés.
pip install evals
Extraits du README du projet sur GitHub. Le droit d'auteur et les licences restent la propriété des auteurs respectifs.
Revendiquez sa page : indexée quel que soit son rang, traduite en six langues, et enrichie de vos propres mots.
Recevez une alerte par e-mail à sa prochaine version ou quand il décolle — ne ratez plus rien.
Gratuit · sans carte · désinscription à tout momentEvals est un cadre pour évaluer les LLMs et les systèmes LLM, et un registre open-source de benchmarks.
evals compte 19.3k étoiles sur GitHub. Il a été forké 3.1k fois. evals est écrit principalement en Python. Il est développé activement depuis 2023.
Evals est un cadre pour évaluer les LLMs et les systèmes LLM, et un registre open-source de benchmarks.
evals est un projet open source.
Oui. evals est gratuit et open source — vous pouvez l'utiliser, le modifier et l'héberger vous-même.
evals est écrit principalement en Python.
Ajoutez ce badge en direct à votre README — vos étoiles GitHub et votre classement dans le répertoire, actualisés quotidiennement.
[](https://olud.ai/project/openai-evals.html)