Un benchmark en conditions réelles pour les agents IA dans le harnais de production.
Évaluez les agents IA en testant leur capacité à effectuer des tâches réelles dans un environnement en direct.
Revendiquez sa page : indexée quel que soit son rang, traduite en six langues, et enrichie de vos propres mots.
Recevez une alerte par e-mail à sa prochaine version ou quand il décolle — ne ratez plus rien.
Gratuit · sans carte · désinscription à tout momentUn benchmark en conditions réelles pour les agents IA dans le harnais de production.
WildClawBench compte 515 étoiles sur GitHub. Il a été forké 61 fois. WildClawBench est écrit principalement en Python. Il est développé activement depuis 2026. WildClawBench est disponible sous licence MIT. Ses principaux thèmes sont : agentic-ai, agentic-evaluation, agents, benchmarks.
Un benchmark en conditions réelles pour les agents IA dans le harnais de production.
WildClawBench est un projet open source. Il est distribué sous licence MIT.
Oui. WildClawBench est gratuit et open source — vous pouvez l'utiliser, le modifier et l'héberger vous-même.
WildClawBench est disponible sous licence MIT.
WildClawBench est écrit principalement en Python.
Ajoutez ce badge en direct à votre README — vos étoiles GitHub et votre classement dans le répertoire, actualisés quotidiennement.
[](https://olud.ai/project/internlm-wildclawbench.html)
Mesuré à partir des topics GitHub communs aux deux projets, pondérés par leur rareté.