Início Projetos continuous-eval
continuous-eval

continuous-eval

por relari-ai · GitHub

Avaliação Orientada a Dados para Aplicações Potencializadas por LLM

Ver no GitHub
⭐ Estrelas
🍴 Forks
📜 Licença
Uso comercial permitido
📅 Criado
🔄 Último commit
🏷️ Categoria
💻 Linguagem
Mantem este projeto?

Reivindique a sua pagina: indexada seja qual for a posicao, traduzida em seis linguas e enriquecida com as suas palavras.

Reivindicar esta pagina →
continuous-eval — GitHub preview card
📈 Histórico de estrelas
516515
2026-07-202026-07-29
📈 Acompanhe continuous-eval

Receba um alerta por e-mail no próximo lançamento ou quando começar a bombar.

Grátis · sem cartão · cancele quando quiser
Receber alertas por e-mail →
📄 Sobre

Avaliação Orientada a Dados para Aplicações Potencializadas por LLM

continuous-eval tem 515 estrelas no GitHub. Foi bifurcado 38 vezes. continuous-eval é escrito principalmente em Python. Está em desenvolvimento ativo desde 2023. continuous-eval está disponível sob a licença Apache-2.0. Os seus principais temas são: evaluation-framework, evaluation-metrics, information-retrieval, llm-evaluation.

Frequently asked questions

O que é continuous-eval?

Avaliação Orientada a Dados para Aplicações Potencializadas por LLM

continuous-eval é de código aberto?

continuous-eval é um projeto de código aberto. É distribuído sob a licença Apache-2.0.

continuous-eval é gratuito?

Sim. continuous-eval é gratuito e de código aberto — você pode usá-lo, modificá-lo e hospedá-lo por conta própria.

Sob que licença está continuous-eval?

continuous-eval está disponível sob a licença Apache-2.0.

Em que linguagem continuous-eval está escrito?

continuous-eval é escrito principalmente em Python.

🏅 Mantenedor deste projeto?
olud.ai badge — continuous-eval

Adicione este badge ao vivo ao seu README — suas estrelas do GitHub e classificação no diretório, atualizadas diariamente.

[![olud.ai](https://olud.ai/badge.php?tool=relari-ai-continuous-eval)](https://olud.ai/project/relari-ai-continuous-eval.html)
Mais opções de badge →
🧬 Partilha ADN com🧬 Ver o mapa de ADN →
tonic_validate
Métricas para avaliar a qualidade das respostas de suas aplicações de Geração Aumentada por Rec…
327 · evaluation-framework
partilhaevaluation-frameworkevaluation-metrics
athina-evals
SDK Python para executar avaliações em respostas geradas por LLM
301 · evaluation
partilhaevaluation-frameworkevaluation-metrics
deepeval
O Framework de Avaliação de LLM
17.2k · evaluation-framework
partilhaevaluation-frameworkevaluation-metrics
llm-leaderboard
Um conjunto abrangente de pontuações de benchmark de LLM e preços de provedores. (obsoleto, lei…
359 · llm
partilhallm-evaluationllmops
open-rag-eval
Avaliação RAG sem a necessidade de "respostas douradas"
385 · evaluation-metrics
partilhaevaluation-metricsretrieval-augmented-generation
agent-search
AgentSearch é uma estrutura para potencializar agentes de busca e permitir busca local personal…
544 · artificial-intelligence
partilhainformation-retrievalretrieval-augmented-generation
FlagEmbedding
Recuperação e LLMs aumentados por recuperação
12k · embeddings
partilhainformation-retrievalretrieval-augmented-generation
lm-evaluation-harness
Uma estrutura para avaliação de poucos exemplos de modelos de linguagem.
13.4k · evaluation-framework
partilhaevaluation-framework
promptfoo
Teste seus prompts, agentes e RAGs. Testes de segurança/pentesting/varredura de vulnerabilidade…
23.7k · ci
Kiln
Construa, Avalie e Otimize Sistemas de IA. Inclui evals, RAG, agentes, ajuste fino, geração de…
5k · ai

Medido a partir dos topics do GitHub comuns aos dois projetos, ponderados pela sua raridade.