Un harness de benchmark de horizonte largo: dele a un agente de codificación un motor de juego real, condiciones profesionales y tiempo, y pídale que construya un juego de mundo abierto. Solo el harness, sin resultados.
Ponga a prueba la capacidad de un agente de codificación para construir un juego de mundo abierto utilizando un motor de juego real y condiciones profesionales.
Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.
Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.
Gratis · sin tarjeta · cancela cuando quierasUn harness de benchmark de horizonte largo: dele a un agente de codificación un motor de juego real, condiciones profesionales y tiempo, y pídale que construya un juego de mundo abierto. Solo el harness, sin resultados.
aaabench tiene 377 estrellas en GitHub. Se ha bifurcado 70 veces. aaabench está escrito principalmente en Shell. Se desarrolla activamente desde 2026. aaabench está disponible bajo la licencia MIT. Sus temas principales son: ai-agents, benchmark, game-development, llm-evaluation.
Un harness de benchmark de horizonte largo: dele a un agente de codificación un motor de juego real, condiciones profesionales y tiempo, y pídale que construya un juego de mundo abierto. Solo el harness, sin resultados.
aaabench es un proyecto de código abierto. Se distribuye bajo la licencia MIT.
Sí. aaabench es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.
aaabench está disponible bajo la licencia MIT.
aaabench está escrito principalmente en Shell.
Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.
[](https://olud.ai/project/ukanwat-aaabench.html)
Medido a partir de los topics de GitHub comunes a ambos proyectos, ponderados por su rareza.