Toolkit zum Linearisieren von PDFs für LLM-Datensätze/Training
Konvertieren Sie PDFs und Bilder in sauberen, lesbaren Text für das Training von KI-Modellen.
Beanspruchen Sie die Seite: indexiert unabhangig vom Rang, in sechs Sprachen ubersetzt und mit Ihren eigenen Worten erganzt.
Erhalten Sie eine E-Mail-Benachrichtigung beim nächsten Release oder wenn es durchstartet.
Kostenlos · ohne Karte · jederzeit abbestellbarToolkit zum Linearisieren von PDFs für LLM-Datensätze/Training
olmocr hat 19.2k Sterne auf GitHub. Es wurde 1.6k-mal geforkt. olmocr ist hauptsächlich in Python geschrieben. Es wird seit 2024 aktiv entwickelt. olmocr ist unter der Apache-2.0-Lizenz verfügbar.
Read the full guideToolkit zum Linearisieren von PDFs für LLM-Datensätze/Training
olmocr ist ein Open-Source-Projekt. Es wird unter der Apache-2.0-Lizenz veröffentlicht.
Ja. olmocr ist kostenlos und Open Source — Sie können es nutzen, anpassen und selbst hosten.
olmocr ist unter der Apache-2.0-Lizenz verfügbar.
olmocr ist hauptsächlich in Python geschrieben.
Fügen Sie dieses Live-Abzeichen zu Ihrem README hinzu — Ihre GitHub-Sterne und Verzeichnisrang, täglich aktualisiert.
[](https://olud.ai/project/allenai-olmocr.html)