Evals es un marco para evaluar LLMs y sistemas LLM, y un registro de benchmarks de código abierto.
Evalúa y prueba modelos de lenguaje grandes con benchmarks existentes o crea tus propias pruebas personalizadas.
pip install evals
Extractos del README del proyecto sobre GitHub. Los derechos de autor y las licencias permanecen con los respectivos autores.
Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.
Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.
Gratis · sin tarjeta · cancela cuando quierasEvals es un marco para evaluar LLMs y sistemas LLM, y un registro de benchmarks de código abierto.
evals tiene 19.3k estrellas en GitHub. Se ha bifurcado 3.1k veces. evals está escrito principalmente en Python. Se desarrolla activamente desde 2023.
Evals es un marco para evaluar LLMs y sistemas LLM, y un registro de benchmarks de código abierto.
evals es un proyecto de código abierto.
Sí. evals es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.
evals está escrito principalmente en Python.
Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.
[](https://olud.ai/project/openai-evals.html)