Ein Vision-Toolkit und eine Fähigkeit, die für reine Textmodelle entwickelt wurden — Bild-Q&A, Langzeit-Screenshot-OCR, Frontend-UI-Wiederherstellung und GUI-Automatisierung, mit optionaler nahtloser Integration für Codex, C
Statten Sie reine Text-Codierungsagenten mit Bildverarbeitungsfähigkeiten aus, wie das Beantworten von Fragen zu Bildern und das Verstehen von Screenshots.
Erhalten Sie eine E-Mail-Benachrichtigung beim nächsten Release oder wenn es durchstartet.
Kostenlos · ohne Karte · jederzeit abbestellbarEin Vision-Toolkit und eine Fähigkeit, die für reine Textmodelle entwickelt wurden — Bild-Q&A, Langzeit-Screenshot-OCR, Frontend-UI-Wiederherstellung und GUI-Automatisierung, mit optionaler nahtloser Integration für Codex, C
agent-vision-toolkit hat 946 Sterne auf GitHub. Es wurde 34-mal geforkt. agent-vision-toolkit ist hauptsächlich in Python geschrieben. Es wird seit 2026 aktiv entwickelt. agent-vision-toolkit ist unter der MIT-Lizenz verfügbar. Die Hauptthemen sind: agent, agent-skills, claude-code, codex.
Ein Vision-Toolkit und eine Fähigkeit, die für reine Textmodelle entwickelt wurden — Bild-Q&A, Langzeit-Screenshot-OCR, Frontend-UI-Wiederherstellung und GUI-Automatisierung, mit optionaler nahtloser Integration für Codex, C
agent-vision-toolkit ist ein Open-Source-Projekt. Es wird unter der MIT-Lizenz veröffentlicht.
Ja. agent-vision-toolkit ist kostenlos und Open Source — Sie können es nutzen, anpassen und selbst hosten.
agent-vision-toolkit ist unter der MIT-Lizenz verfügbar.
agent-vision-toolkit ist hauptsächlich in Python geschrieben.
Fügen Sie dieses Live-Abzeichen zu Ihrem README hinzu — Ihre GitHub-Sterne und Verzeichnisrang, täglich aktualisiert.
[](https://olud.ai/project/anionex-agent-vision-toolkit.html)
Ermittelt aus gemeinsamen GitHub-Topics beider Projekte, gewichtet nach ihrer Seltenheit.