Evals est un cadre pour évaluer les LLMs et les systèmes LLM, et un registre open-source de benchmarks.
Évaluez et testez des modèles de langage de grande taille avec des benchmarks existants ou créez vos propres tests personnalisés.
Revendiquez sa page : indexée quel que soit son rang, traduite en six langues, et enrichie de vos propres mots.
Recevez une alerte par e-mail à sa prochaine version ou quand il décolle — ne ratez plus rien.
Gratuit · sans carte · désinscription à tout momentEvals est un cadre pour évaluer les LLMs et les systèmes LLM, et un registre open-source de benchmarks.
evals compte 19k étoiles sur GitHub. Il a été forké 3k fois. evals est écrit principalement en Python. Il est développé activement depuis 2023.
Evals est un cadre pour évaluer les LLMs et les systèmes LLM, et un registre open-source de benchmarks.
evals est un projet open source.
Oui. evals est gratuit et open source — vous pouvez l'utiliser, le modifier et l'héberger vous-même.
evals est écrit principalement en Python.
Ajoutez ce badge en direct à votre README — vos étoiles GitHub et votre classement dans le répertoire, actualisés quotidiennement.
[](https://opensourceai.tech/project/openai-evals.html)