Inicio Proyectos evals
evals
Python

evals

Evals es un marco para evaluar LLMs y sistemas LLM, y un registro de benchmarks de código abierto.

por openai · GitHub
Estrellas
Ramas
Creado
Último commit
Lenguaje
Python
Ver en GitHub
En palabras simples

Evalúa y prueba modelos de lenguaje grandes con benchmarks existentes o crea tus propias pruebas personalizadas.

Del README

Instalar
pip install evals

Extractos del README del proyecto sobre GitHub. Los derechos de autor y las licencias permanecen con los respectivos autores.

¿Mantienes este proyecto?

Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.

Reivindicar esta pagina →
evals — GitHub preview card
📈 Historial de estrellas
19.3k18.9k
2026-07-122026-08-31
📈 Sigue evals

Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.

Gratis · sin tarjeta · cancela cuando quieras
Recibir alertas por email →
📄 Acerca de

Evals es un marco para evaluar LLMs y sistemas LLM, y un registro de benchmarks de código abierto.

evals tiene 19.3k estrellas en GitHub. Se ha bifurcado 3.1k veces. evals está escrito principalmente en Python. Se desarrolla activamente desde 2023.

Frequently asked questions

¿Qué es evals?

Evals es un marco para evaluar LLMs y sistemas LLM, y un registro de benchmarks de código abierto.

¿evals es de código abierto?

evals es un proyecto de código abierto.

¿evals es gratis?

Sí. evals es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.

¿En qué lenguaje está escrito evals?

evals está escrito principalmente en Python.

🏅 ¿Mantenedor de este proyecto?
olud.ai badge — evals

Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.

[![olud.ai](https://olud.ai/badge.php?tool=openai-evals)](https://olud.ai/project/openai-evals.html)
Más opciones de distintivos →
🧬 Proyectos relacionados