Un benchmark in-the-wild para agentes de IA en el harness de producción.
Evalúa a los agentes de IA probando su capacidad para realizar tareas reales en un entorno en vivo.
Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.
Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.
Gratis · sin tarjeta · cancela cuando quierasUn benchmark in-the-wild para agentes de IA en el harness de producción.
WildClawBench tiene 515 estrellas en GitHub. Se ha bifurcado 61 veces. WildClawBench está escrito principalmente en Python. Se desarrolla activamente desde 2026. WildClawBench está disponible bajo la licencia MIT. Sus temas principales son: agentic-ai, agentic-evaluation, agents, benchmarks.
Un benchmark in-the-wild para agentes de IA en el harness de producción.
WildClawBench es un proyecto de código abierto. Se distribuye bajo la licencia MIT.
Sí. WildClawBench es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.
WildClawBench está disponible bajo la licencia MIT.
WildClawBench está escrito principalmente en Python.
Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.
[](https://olud.ai/project/internlm-wildclawbench.html)
Medido a partir de los topics de GitHub comunes a ambos proyectos, ponderados por su rareza.