Inicio Proyectos continuous-eval
continuous-eval

continuous-eval

por relari-ai · GitHub

Evaluación basada en datos para aplicaciones impulsadas por LLM.

Ver en GitHub
⭐ Estrellas
🍴 Ramas
📜 Licencia
Uso comercial permitido
📅 Creado
🔄 Último commit
🏷️ Categoría
💻 Lenguaje
¿Mantienes este proyecto?

Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.

Reivindicar esta pagina →
continuous-eval — GitHub preview card
📈 Historial de estrellas
516515
2026-07-202026-07-29
📈 Sigue continuous-eval

Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.

Gratis · sin tarjeta · cancela cuando quieras
Recibir alertas por email →
📄 Acerca de

Evaluación basada en datos para aplicaciones impulsadas por LLM.

continuous-eval tiene 515 estrellas en GitHub. Se ha bifurcado 38 veces. continuous-eval está escrito principalmente en Python. Se desarrolla activamente desde 2023. continuous-eval está disponible bajo la licencia Apache-2.0. Sus temas principales son: evaluation-framework, evaluation-metrics, information-retrieval, llm-evaluation.

Frequently asked questions

¿Qué es continuous-eval?

Evaluación basada en datos para aplicaciones impulsadas por LLM.

¿continuous-eval es de código abierto?

continuous-eval es un proyecto de código abierto. Se distribuye bajo la licencia Apache-2.0.

¿continuous-eval es gratis?

Sí. continuous-eval es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.

¿Bajo qué licencia está continuous-eval?

continuous-eval está disponible bajo la licencia Apache-2.0.

¿En qué lenguaje está escrito continuous-eval?

continuous-eval está escrito principalmente en Python.

🏅 ¿Mantenedor de este proyecto?
olud.ai badge — continuous-eval

Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.

[![olud.ai](https://olud.ai/badge.php?tool=relari-ai-continuous-eval)](https://olud.ai/project/relari-ai-continuous-eval.html)
Más opciones de distintivos →
🧬 Comparte ADN con🧬 Ver el mapa de ADN →
tonic_validate
Métricas para evaluar la calidad de las respuestas de tus aplicaciones de Generación Aumentada…
327 · evaluation-framework
comparteevaluation-frameworkevaluation-metrics
athina-evals
SDK de Python para ejecutar evaluaciones sobre respuestas generadas por LLM
301 · evaluation
comparteevaluation-frameworkevaluation-metrics
deepeval
El marco de evaluación de LLM
17.2k · evaluation-framework
comparteevaluation-frameworkevaluation-metrics
llm-leaderboard
Un conjunto completo de puntuaciones de referencia de LLM y precios de proveedores. (obsoleto,…
359 · llm
compartellm-evaluationllmops
open-rag-eval
Evaluación RAG sin necesidad de "respuestas doradas"
385 · evaluation-metrics
comparteevaluation-metricsretrieval-augmented-generation
agent-search
AgentSearch es un marco para potenciar agentes de búsqueda y habilitar búsqueda local personali…
544 · artificial-intelligence
comparteinformation-retrievalretrieval-augmented-generation
FlagEmbedding
Recuperación y LLMs aumentados por recuperación
12k · embeddings
comparteinformation-retrievalretrieval-augmented-generation
lm-evaluation-harness
Un marco para la evaluación de pocos disparos de modelos de lenguaje.
13.4k · evaluation-framework
comparteevaluation-framework
promptfoo
Prueba tus prompts, agentes y RAGs. Pruebas de seguridad/pentesting/escaneo de vulnerabilidades…
23.7k · ci
Kiln
Construye, evalúa y optimiza sistemas de IA. Incluye evals, RAG, agentes, ajuste fino, generaci…
5k · ai

Medido a partir de los topics de GitHub comunes a ambos proyectos, ponderados por su rareza.