Bewerten & Benchmarken von KI-Coding-Agenten und Claude Code-Fähigkeiten — sandboxed, reproduzierbare YAML-Evaluierungssuiten für Claude Code, Codex & Gemini, mit A/B-Experimenten und CI-Gates.
Beanspruchen Sie die Seite: indexiert unabhangig vom Rang, in sechs Sprachen ubersetzt und mit Ihren eigenen Worten erganzt.
Erhalten Sie eine E-Mail-Benachrichtigung beim nächsten Release oder wenn es durchstartet.
Kostenlos · ohne Karte · jederzeit abbestellbarBewerten & Benchmarken von KI-Coding-Agenten und Claude Code-Fähigkeiten — sandboxed, reproduzierbare YAML-Evaluierungssuiten für Claude Code, Codex & Gemini, mit A/B-Experimenten und CI-Gates.
coder_eval hat 107 Sterne auf GitHub. Es wurde 2-mal geforkt. coder_eval ist hauptsächlich in Python geschrieben. Es wird seit 2026 aktiv entwickelt. coder_eval ist unter der Apache-2.0-Lizenz verfügbar. Die Hauptthemen sind: agent-evaluation, agent-testing, ai-agents, ai-evaluation.
Bewerten & Benchmarken von KI-Coding-Agenten und Claude Code-Fähigkeiten — sandboxed, reproduzierbare YAML-Evaluierungssuiten für Claude Code, Codex & Gemini, mit A/B-Experimenten und CI-Gates.
coder_eval ist ein Open-Source-Projekt. Es wird unter der Apache-2.0-Lizenz veröffentlicht.
Ja. coder_eval ist kostenlos und Open Source — Sie können es nutzen, anpassen und selbst hosten.
coder_eval ist unter der Apache-2.0-Lizenz verfügbar.
coder_eval ist hauptsächlich in Python geschrieben.
Fügen Sie dieses Live-Abzeichen zu Ihrem README hinzu — Ihre GitHub-Sterne und Verzeichnisrang, täglich aktualisiert.
[](https://opensourceai.tech/project/uipath-coder-eval.html)
Ermittelt aus gemeinsamen GitHub-Topics beider Projekte, gewichtet nach ihrer Seltenheit.