Un benchmark harness a lungo termine: dia a un agente di codifica un vero motore di gioco, condizioni professionali e tempo, e gli chieda di costruire un gioco open-world. Solo harness, nessun risultato.
Testi la capacità di un agente di codifica di costruire un gioco open-world usando un vero motore di gioco e condizioni professionali.
Rivendica la sua pagina: indicizzata qualunque sia il rango, tradotta in sei lingue e arricchita con le tue parole.
Ricevi un avviso via email alla prossima release o quando decolla — non perderti nulla.
Gratis · senza carta · disdici quando vuoiUn benchmark harness a lungo termine: dia a un agente di codifica un vero motore di gioco, condizioni professionali e tempo, e gli chieda di costruire un gioco open-world. Solo harness, nessun risultato.
aaabench ha 377 stelle su GitHub. È stato forkato 70 volte. aaabench è scritto principalmente in Shell. È in sviluppo attivo dal 2026. aaabench è disponibile con licenza MIT. I suoi temi principali sono: ai-agents, benchmark, game-development, llm-evaluation.
Un benchmark harness a lungo termine: dia a un agente di codifica un vero motore di gioco, condizioni professionali e tempo, e gli chieda di costruire un gioco open-world. Solo harness, nessun risultato.
aaabench è un progetto open source. È rilasciato con licenza MIT.
Sì. aaabench è gratuito e open source: puoi usarlo, modificarlo e ospitarlo autonomamente.
aaabench è disponibile con licenza MIT.
aaabench è scritto principalmente in Shell.
Aggiungi questo badge live al tuo README — le tue stelle GitHub e il ranking della directory, aggiornati quotidianamente.
[](https://olud.ai/project/ukanwat-aaabench.html)
Misurato dai topic GitHub comuni a entrambi i progetti, ponderati per la loro rarita.