Início Projetos evals
evals
Python

evals

Evals é um framework para avaliar LLMs e sistemas LLM, e um registro de benchmarks de código aberto.

por openai · GitHub
Estrelas
Forks
Tendências
Criado
Último commit
Linguagem
Python
Ver no GitHub
Em palavras simples

Avalie e teste grandes modelos de linguagem com benchmarks existentes ou crie seus próprios testes personalizados.

Do README

Instalar
pip install evals

Trechos do README do projeto em GitHub. Os direitos autorais e as licenças permanecem com os respectivos autores.

Mantem este projeto?

Reivindique a sua pagina: indexada seja qual for a posicao, traduzida em seis linguas e enriquecida com as suas palavras.

Reivindicar esta pagina →
evals — GitHub preview card
📈 Histórico de estrelas
19.3k18.9k
2026-07-122026-08-31
📈 Acompanhe evals

Receba um alerta por e-mail no próximo lançamento ou quando começar a bombar.

Grátis · sem cartão · cancele quando quiser
Receber alertas por e-mail →
📄 Sobre

Evals é um framework para avaliar LLMs e sistemas LLM, e um registro de benchmarks de código aberto.

evals tem 19.3k estrelas no GitHub. Foi bifurcado 3.1k vezes. evals é escrito principalmente em Python. Está em desenvolvimento ativo desde 2023.

Frequently asked questions

O que é evals?

Evals é um framework para avaliar LLMs e sistemas LLM, e um registro de benchmarks de código aberto.

evals é de código aberto?

evals é um projeto de código aberto.

evals é gratuito?

Sim. evals é gratuito e de código aberto — você pode usá-lo, modificá-lo e hospedá-lo por conta própria.

Em que linguagem evals está escrito?

evals é escrito principalmente em Python.

🏅 Mantenedor deste projeto?
olud.ai badge — evals

Adicione este badge ao vivo ao seu README — suas estrelas do GitHub e classificação no diretório, atualizadas diariamente.

[![olud.ai](https://olud.ai/badge.php?tool=openai-evals)](https://olud.ai/project/openai-evals.html)
Mais opções de badge →
🧬 Projetos relacionados