Início Projetos athina-evals
athina-evals
Python

athina-evals

SDK Python para executar avaliações em respostas geradas por LLM

por athina-ai · GitHub
Estrelas
Forks
Criado
Último commit
Categoria
Linguagem
evaluationevaluation-frameworkevaluation-metricsPython
Ver no GitHub
Em palavras simples

Realize avaliações em respostas geradas por IA usando o Athina SDK para melhorar o desempenho do modelo.

Mantem este projeto?

Reivindique a sua pagina: indexada seja qual for a posicao, traduzida em seis linguas e enriquecida com as suas palavras.

Reivindicar esta pagina →
athina-evals — GitHub preview card
📈 Histórico de estrelas
302301
2026-07-202026-08-17
📈 Acompanhe athina-evals

Receba um alerta por e-mail no próximo lançamento ou quando começar a bombar.

Grátis · sem cartão · cancele quando quiser
Receber alertas por e-mail →
📄 Sobre

SDK Python para executar avaliações em respostas geradas por LLM

athina-evals tem 301 estrelas no GitHub. Foi bifurcado 22 vezes. athina-evals é escrito principalmente em Python. Está em desenvolvimento ativo desde 2023. Os seus principais temas são: evaluation, evaluation-framework, evaluation-metrics, llm-eval.

Frequently asked questions

O que é athina-evals?

SDK Python para executar avaliações em respostas geradas por LLM

athina-evals é de código aberto?

athina-evals é um projeto de código aberto.

athina-evals é gratuito?

Sim. athina-evals é gratuito e de código aberto — você pode usá-lo, modificá-lo e hospedá-lo por conta própria.

Em que linguagem athina-evals está escrito?

athina-evals é escrito principalmente em Python.

🏅 Mantenedor deste projeto?
olud.ai badge — athina-evals

Adicione este badge ao vivo ao seu README — suas estrelas do GitHub e classificação no diretório, atualizadas diariamente.

[![olud.ai](https://olud.ai/badge.php?tool=athina-ai-athina-evals)](https://olud.ai/project/athina-ai-athina-evals.html)
Mais opções de badge →
🧬 Partilha ADN com🧬 Ver o mapa de ADN →
continuous-eval
Avaliação Orientada a Dados para Aplicações Potencializadas por LLM
516 · evaluation-framework
partilhaevaluation-frameworkevaluation-metrics
tonic_validate
Métricas para avaliar a qualidade das respostas de suas aplicações de Geração Aumentada por Rec…
327 · evaluation-framework
partilhaevaluation-frameworkevaluation-metrics
deepeval
O Framework de Avaliação de LLM
17.6k · evaluation-framework
partilhaevaluation-frameworkevaluation-metrics
lm-evaluation-harness
Uma estrutura para avaliação de poucos exemplos de modelos de linguagem.
13.7k · evaluation-framework
partilhaevaluation-framework
AgentLab
AgentLab: Uma estrutura de código aberto para desenvolver, testar e avaliar agentes web em dive…
606 · agent
partilhaevaluation-framework
tiny-universe
《大模型白盒子构建指南》:一个全手搓的Tiny-Universe
5k · agent
partilhaevaluation-metrics
DreamLayer
Modelos de difusão de benchmark mais rápidos. Automatize avaliações, sementes e métricas para r…
411 · benchmarking
partilhaevaluation-metrics
Awesome-Evaluation-of-Visual-Generation
Uma lista de trabalhos sobre avaliação de modelos de geração visual, incluindo métricas de aval…
454 · awesome
partilhaevaluation-metrics
open-rag-eval
Avaliação RAG sem a necessidade de "respostas douradas"
384 · evaluation-metrics
partilhaevaluation-metrics
langfuse
🪢 Plataforma de engenharia de IA open source: avaliações de LLM, observabilidade, métricas, ger…
33.2k · analytics

Medido a partir dos topics do GitHub comuns aos dois projetos, ponderados pela sua raridade.