Un harnais de benchmark à long horizon : donnez à un agent de codage un véritable moteur de jeu, des conditions professionnelles et du temps, et demandez-lui de construire un jeu en monde ouvert. Harnais uniquement, pas de résultats.
Testez la capacité d'un agent de codage à construire un jeu en monde ouvert en utilisant un moteur de jeu réel et des conditions professionnelles.
Revendiquez sa page : indexée quel que soit son rang, traduite en six langues, et enrichie de vos propres mots.
Recevez une alerte par e-mail à sa prochaine version ou quand il décolle — ne ratez plus rien.
Gratuit · sans carte · désinscription à tout momentUn harnais de benchmark à long horizon : donnez à un agent de codage un véritable moteur de jeu, des conditions professionnelles et du temps, et demandez-lui de construire un jeu en monde ouvert. Harnais uniquement, pas de résultats.
aaabench compte 377 étoiles sur GitHub. Il a été forké 70 fois. aaabench est écrit principalement en Shell. Il est développé activement depuis 2026. aaabench est disponible sous licence MIT. Ses principaux thèmes sont : ai-agents, benchmark, game-development, llm-evaluation.
Un harnais de benchmark à long horizon : donnez à un agent de codage un véritable moteur de jeu, des conditions professionnelles et du temps, et demandez-lui de construire un jeu en monde ouvert. Harnais uniquement, pas de résultats.
aaabench est un projet open source. Il est distribué sous licence MIT.
Oui. aaabench est gratuit et open source — vous pouvez l'utiliser, le modifier et l'héberger vous-même.
aaabench est disponible sous licence MIT.
aaabench est écrit principalement en Shell.
Ajoutez ce badge en direct à votre README — vos étoiles GitHub et votre classement dans le répertoire, actualisés quotidiennement.
[](https://olud.ai/project/ukanwat-aaabench.html)
Mesuré à partir des topics GitHub communs aux deux projets, pondérés par leur rareté.