Evals es un marco para evaluar LLMs y sistemas LLM, y un registro de benchmarks de código abierto.
Evalúa y prueba grandes modelos de lenguaje con benchmarks existentes o crea tus propias pruebas personalizadas.
Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.
Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.
Gratis · sin tarjeta · cancela cuando quierasEvals es un marco para evaluar LLMs y sistemas LLM, y un registro de benchmarks de código abierto.
evals tiene 19k estrellas en GitHub. Se ha bifurcado 3k veces. evals está escrito principalmente en Python. Se desarrolla activamente desde 2023.
Evals es un marco para evaluar LLMs y sistemas LLM, y un registro de benchmarks de código abierto.
evals es un proyecto de código abierto.
Sí. evals es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.
evals está escrito principalmente en Python.
Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.
[](https://opensourceai.tech/project/openai-evals.html)