τ-Bench: Un benchmark per l'interazione Strumento-Agente-Utente in domini del mondo reale
Valuta quanto bene gli agenti AI svolgono compiti in scenari reali con uno strumento di benchmarking.
Rivendica la sua pagina: indicizzata qualunque sia il rango, tradotta in sei lingue e arricchita con le tue parole.
Ricevi un avviso via email alla prossima release o quando decolla — non perderti nulla.
Gratis · senza carta · disdici quando vuoiτ-Bench: Un benchmark per l'interazione Strumento-Agente-Utente in domini del mondo reale
tau2-bench ha 1.7k stelle su GitHub. È stato forkato 426 volte. tau2-bench è scritto principalmente in Python. È in sviluppo attivo dal 2025. tau2-bench è disponibile con licenza MIT. I suoi temi principali sono: ai, benchmark, conversational-agents, language-model-agent.
τ-Bench: Un benchmark per l'interazione Strumento-Agente-Utente in domini del mondo reale
tau2-bench è un progetto open source. È rilasciato con licenza MIT.
Sì. tau2-bench è gratuito e open source: puoi usarlo, modificarlo e ospitarlo autonomamente.
tau2-bench è disponibile con licenza MIT.
tau2-bench è scritto principalmente in Python.
Aggiungi questo badge live al tuo README — le tue stelle GitHub e il ranking della directory, aggiornati quotidianamente.
[](https://olud.ai/project/sierra-research-tau2-bench.html)
Misurato dai topic GitHub comuni a entrambi i progetti, ponderati per la loro rarita.