τ-Bench: Ein Benchmark für Tool-Agent-User-Interaktion in realen Anwendungsbereichen.
Bewerten Sie, wie gut KI-Agenten Aufgaben in realen Szenarien mit einem Benchmarking-Tool ausführen.
Beanspruchen Sie die Seite: indexiert unabhangig vom Rang, in sechs Sprachen ubersetzt und mit Ihren eigenen Worten erganzt.
Erhalten Sie eine E-Mail-Benachrichtigung beim nächsten Release oder wenn es durchstartet.
Kostenlos · ohne Karte · jederzeit abbestellbarτ-Bench: Ein Benchmark für Tool-Agent-User-Interaktion in realen Anwendungsbereichen.
tau2-bench hat 1.7k Sterne auf GitHub. Es wurde 426-mal geforkt. tau2-bench ist hauptsächlich in Python geschrieben. Es wird seit 2025 aktiv entwickelt. tau2-bench ist unter der MIT-Lizenz verfügbar. Die Hauptthemen sind: ai, benchmark, conversational-agents, language-model-agent.
τ-Bench: Ein Benchmark für Tool-Agent-User-Interaktion in realen Anwendungsbereichen.
tau2-bench ist ein Open-Source-Projekt. Es wird unter der MIT-Lizenz veröffentlicht.
Ja. tau2-bench ist kostenlos und Open Source — Sie können es nutzen, anpassen und selbst hosten.
tau2-bench ist unter der MIT-Lizenz verfügbar.
tau2-bench ist hauptsächlich in Python geschrieben.
Fügen Sie dieses Live-Abzeichen zu Ihrem README hinzu — Ihre GitHub-Sterne und Verzeichnisrang, täglich aktualisiert.
[](https://olud.ai/project/sierra-research-tau2-bench.html)
Ermittelt aus gemeinsamen GitHub-Topics beider Projekte, gewichtet nach ihrer Seltenheit.