Evals é um framework para avaliar LLMs e sistemas LLM, e um registro de benchmarks de código aberto.
Avalie e teste grandes modelos de linguagem com benchmarks existentes ou crie seus próprios testes personalizados.
Reivindique a sua pagina: indexada seja qual for a posicao, traduzida em seis linguas e enriquecida com as suas palavras.
Receba um alerta por e-mail no próximo lançamento ou quando começar a bombar.
Grátis · sem cartão · cancele quando quiserEvals é um framework para avaliar LLMs e sistemas LLM, e um registro de benchmarks de código aberto.
evals tem 19k estrelas no GitHub. Foi bifurcado 3k vezes. evals é escrito principalmente em Python. Está em desenvolvimento ativo desde 2023.
Evals é um framework para avaliar LLMs e sistemas LLM, e um registro de benchmarks de código aberto.
evals é um projeto de código aberto.
Sim. evals é gratuito e de código aberto — você pode usá-lo, modificá-lo e hospedá-lo por conta própria.
evals é escrito principalmente em Python.
Adicione este badge ao vivo ao seu README — suas estrelas do GitHub e classificação no diretório, atualizadas diariamente.
[](https://opensourceai.tech/project/openai-evals.html)