Um benchmark harness de longo horizonte: dê a um agente de codificação um motor de jogo real, condições profissionais e tempo, e peça para ele construir um jogo de mundo aberto. Apenas o harness, sem resultados.
Teste a capacidade de um agente de codificação de construir um jogo de mundo aberto usando um motor de jogo real e condições profissionais.
Reivindique a sua pagina: indexada seja qual for a posicao, traduzida em seis linguas e enriquecida com as suas palavras.
Receba um alerta por e-mail no próximo lançamento ou quando começar a bombar.
Grátis · sem cartão · cancele quando quiserUm benchmark harness de longo horizonte: dê a um agente de codificação um motor de jogo real, condições profissionais e tempo, e peça para ele construir um jogo de mundo aberto. Apenas o harness, sem resultados.
aaabench tem 377 estrelas no GitHub. Foi bifurcado 70 vezes. aaabench é escrito principalmente em Shell. Está em desenvolvimento ativo desde 2026. aaabench está disponível sob a licença MIT. Os seus principais temas são: ai-agents, benchmark, game-development, llm-evaluation.
Um benchmark harness de longo horizonte: dê a um agente de codificação um motor de jogo real, condições profissionais e tempo, e peça para ele construir um jogo de mundo aberto. Apenas o harness, sem resultados.
aaabench é um projeto de código aberto. É distribuído sob a licença MIT.
Sim. aaabench é gratuito e de código aberto — você pode usá-lo, modificá-lo e hospedá-lo por conta própria.
aaabench está disponível sob a licença MIT.
aaabench é escrito principalmente em Shell.
Adicione este badge ao vivo ao seu README — suas estrelas do GitHub e classificação no diretório, atualizadas diariamente.
[](https://olud.ai/project/ukanwat-aaabench.html)
Medido a partir dos topics do GitHub comuns aos dois projetos, ponderados pela sua raridade.