Accueil Projets athina-evals
athina-evals
Python

athina-evals

SDK Python pour exécuter des évaluations sur les réponses générées par LLM

par athina-ai · GitHub
Étoiles
Forks
Créé
Dernier commit
Catégorie
Langue
evaluationevaluation-frameworkevaluation-metricsPython
Voir sur GitHub
En termes simples

Exécutez des évaluations sur les réponses générées par l'IA en utilisant le SDK Athina pour améliorer les performances du modèle.

Vous maintenez ce projet ?

Revendiquez sa page : indexée quel que soit son rang, traduite en six langues, et enrichie de vos propres mots.

Revendiquer cette page →
athina-evals — GitHub preview card
📈 Historique des étoiles
302301
2026-07-202026-08-17
📈 Suivez athina-evals

Recevez une alerte par e-mail à sa prochaine version ou quand il décolle — ne ratez plus rien.

Gratuit · sans carte · désinscription à tout moment
Recevoir des alertes e-mail →
📄 À propos

SDK Python pour exécuter des évaluations sur les réponses générées par LLM

athina-evals compte 301 étoiles sur GitHub. Il a été forké 22 fois. athina-evals est écrit principalement en Python. Il est développé activement depuis 2023. Ses principaux thèmes sont : evaluation, evaluation-framework, evaluation-metrics, llm-eval.

Frequently asked questions

Qu'est-ce que athina-evals ?

SDK Python pour exécuter des évaluations sur les réponses générées par LLM

athina-evals est-il open source ?

athina-evals est un projet open source.

athina-evals est-il gratuit ?

Oui. athina-evals est gratuit et open source — vous pouvez l'utiliser, le modifier et l'héberger vous-même.

Dans quel langage athina-evals est-il écrit ?

athina-evals est écrit principalement en Python.

🏅 Mainteneur de ce projet ?
olud.ai badge — athina-evals

Ajoutez ce badge en direct à votre README — vos étoiles GitHub et votre classement dans le répertoire, actualisés quotidiennement.

[![olud.ai](https://olud.ai/badge.php?tool=athina-ai-athina-evals)](https://olud.ai/project/athina-ai-athina-evals.html)
Plus d'options de badge →
🧬 Partage son ADN avec🧬 Voir la cartographie ADN →
continuous-eval
Évaluation basée sur les données pour les applications alimentées par LLM.
516 · evaluation-framework
partageevaluation-frameworkevaluation-metrics
tonic_validate
Métriques pour évaluer la qualité des réponses de vos applications de Génération Augmentée par…
327 · evaluation-framework
partageevaluation-frameworkevaluation-metrics
deepeval
Le cadre d'évaluation LLM
17.6k · evaluation-framework
partageevaluation-frameworkevaluation-metrics
lm-evaluation-harness
Un cadre pour l'évaluation par quelques exemples des modèles de langage.
13.7k · evaluation-framework
partageevaluation-framework
AgentLab
AgentLab : Un cadre open-source pour développer, tester et évaluer des agents web sur des tâche…
606 · agent
partageevaluation-framework
tiny-universe
《大模型白盒子构建指南》:一个全手搓的Tiny-Universe
5k · agent
partageevaluation-metrics
DreamLayer
Modèles de diffusion de référence plus rapides. Automatisez les évaluations, les graines et les…
411 · benchmarking
partageevaluation-metrics
Awesome-Evaluation-of-Visual-Generation
Une liste de travaux sur l'évaluation des modèles de génération visuelle, y compris les métriqu…
454 · awesome
partageevaluation-metrics
open-rag-eval
Évaluation RAG sans besoin de "réponses dorées"
384 · evaluation-metrics
partageevaluation-metrics
langfuse
🪢 Plateforme d'ingénierie AI open source : évaluations LLM, observabilité, métriques, gestion d…
33.2k · analytics

Mesuré à partir des topics GitHub communs aux deux projets, pondérés par leur rareté.