Um benchmark in-the-wild para agentes de IA no ambiente de produção.
Avalie agentes de IA testando sua capacidade de realizar tarefas reais em um ambiente ao vivo.
Reivindique a sua pagina: indexada seja qual for a posicao, traduzida em seis linguas e enriquecida com as suas palavras.
Receba um alerta por e-mail no próximo lançamento ou quando começar a bombar.
Grátis · sem cartão · cancele quando quiserUm benchmark in-the-wild para agentes de IA no ambiente de produção.
WildClawBench tem 515 estrelas no GitHub. Foi bifurcado 61 vezes. WildClawBench é escrito principalmente em Python. Está em desenvolvimento ativo desde 2026. WildClawBench está disponível sob a licença MIT. Os seus principais temas são: agentic-ai, agentic-evaluation, agents, benchmarks.
Um benchmark in-the-wild para agentes de IA no ambiente de produção.
WildClawBench é um projeto de código aberto. É distribuído sob a licença MIT.
Sim. WildClawBench é gratuito e de código aberto — você pode usá-lo, modificá-lo e hospedá-lo por conta própria.
WildClawBench está disponível sob a licença MIT.
WildClawBench é escrito principalmente em Python.
Adicione este badge ao vivo ao seu README — suas estrelas do GitHub e classificação no diretório, atualizadas diariamente.
[](https://olud.ai/project/internlm-wildclawbench.html)
Medido a partir dos topics do GitHub comuns aos dois projetos, ponderados pela sua raridade.