Início Projetos continuous-eval
continuous-eval
Python

continuous-eval

Avaliação Orientada a Dados para Aplicações Potencializadas por LLM

por relari-ai · GitHub
Estrelas
Forks
Licença
Criado
Último commit
Linguagem
evaluation-frameworkevaluation-metricsinformation-retrievalApache-2.0Python
Ver no GitHub
Em palavras simples

Avalie o desempenho de aplicações de IA usando métricas personalizadas para várias tarefas.

Mantem este projeto?

Reivindique a sua pagina: indexada seja qual for a posicao, traduzida em seis linguas e enriquecida com as suas palavras.

Reivindicar esta pagina →
continuous-eval — GitHub preview card
📈 Histórico de estrelas
517516
2026-07-202026-08-31
📈 Acompanhe continuous-eval

Receba um alerta por e-mail no próximo lançamento ou quando começar a bombar.

Grátis · sem cartão · cancele quando quiser
Receber alertas por e-mail →
📄 Sobre

Avaliação Orientada a Dados para Aplicações Potencializadas por LLM

continuous-eval tem 516 estrelas no GitHub. Foi bifurcado 38 vezes. continuous-eval é escrito principalmente em Python. Está em desenvolvimento ativo desde 2023. continuous-eval está disponível sob a licença Apache-2.0. Os seus principais temas são: evaluation-framework, evaluation-metrics, information-retrieval, llm-evaluation.

Frequently asked questions

O que é continuous-eval?

Avaliação Orientada a Dados para Aplicações Potencializadas por LLM

continuous-eval é de código aberto?

continuous-eval é um projeto de código aberto. É distribuído sob a licença Apache-2.0.

continuous-eval é gratuito?

Sim. continuous-eval é gratuito e de código aberto — você pode usá-lo, modificá-lo e hospedá-lo por conta própria.

Sob que licença está continuous-eval?

continuous-eval está disponível sob a licença Apache-2.0.

Em que linguagem continuous-eval está escrito?

continuous-eval é escrito principalmente em Python.

🏅 Mantenedor deste projeto?
olud.ai badge — continuous-eval

Adicione este badge ao vivo ao seu README — suas estrelas do GitHub e classificação no diretório, atualizadas diariamente.

[![olud.ai](https://olud.ai/badge.php?tool=relari-ai-continuous-eval)](https://olud.ai/project/relari-ai-continuous-eval.html)
Mais opções de badge →
🧬 Partilha ADN com🧬 Ver o mapa de ADN →
deepeval
O Framework de Avaliação de LLM
18k · evaluation-framework
partilhaevaluation-frameworkevaluation-metrics
athina-evals
Python SDK for running evaluations on LLM generated responses
301 · evaluation
partilhaevaluation-frameworkevaluation-metrics
tonic_validate
Métricas para avaliar a qualidade das respostas de suas aplicações de Geração Aumentada por Rec…
327 · evaluation-framework
partilhaevaluation-frameworkevaluation-metrics
lm-evaluation-harness
Uma estrutura para avaliação de poucos exemplos de modelos de linguagem.
13.8k · evaluation-framework
partilhaevaluation-framework
AgentLab
AgentLab: Uma estrutura de código aberto para desenvolver, testar e avaliar agentes web em dive…
606 · agent
partilhaevaluation-framework
tiny-universe
《大模型白盒子构建指南》:一个全手搓的Tiny-Universe
5k · agent
partilhaevaluation-metrics
DreamLayer
Modelos de difusão de benchmark mais rápidos. Automatize avaliações, sementes e métricas para r…
411 · benchmarking
partilhaevaluation-metrics
Awesome-Evaluation-of-Visual-Generation
Uma lista de trabalhos sobre avaliação de modelos de geração visual, incluindo métricas de aval…
454 · awesome
partilhaevaluation-metrics
Rankify
🔥 Rankify: Um Conjunto Abrangente de Ferramentas Python para Recuperação, Re-Ranking e Geração…
680 · agent
partilhainformation-retrieval
LLM4IR-Survey
Este é o repositório para a pesquisa de LLM4IR.
545 · information-retrieval
partilhainformation-retrieval

Medido a partir dos topics do GitHub comuns aos dois projetos, ponderados pela sua raridade.