Améliore la sortie OCR de Tesseract en utilisant des LLM (local ou API) pour la correction d'erreurs, le découpage intelligent et le formatage markdown des PDF scannés.
Améliorez les documents numérisés en corrigeant les erreurs de texte et en les formatant proprement à l'aide de techniques avancées de traitement du langage.
Revendiquez sa page : indexée quel que soit son rang, traduite en six langues, et enrichie de vos propres mots.
Recevez une alerte par e-mail à sa prochaine version ou quand il décolle — ne ratez plus rien.
Gratuit · sans carte · désinscription à tout momentAméliore la sortie OCR de Tesseract en utilisant des LLM (local ou API) pour la correction d'erreurs, le découpage intelligent et le formatage markdown des PDF scannés.
llm_aided_ocr compte 2.9k étoiles sur GitHub. Il a été forké 207 fois. llm_aided_ocr est écrit principalement en Python. Il est développé activement depuis 2023. Ses principaux thèmes sont : ai-assist, llama2, llm, ocr.
Améliore la sortie OCR de Tesseract en utilisant des LLM (local ou API) pour la correction d'erreurs, le découpage intelligent et le formatage markdown des PDF scannés.
llm_aided_ocr est un projet open source.
Oui. llm_aided_ocr est gratuit et open source — vous pouvez l'utiliser, le modifier et l'héberger vous-même.
llm_aided_ocr est écrit principalement en Python.
Ajoutez ce badge en direct à votre README — vos étoiles GitHub et votre classement dans le répertoire, actualisés quotidiennement.
[](https://opensourceai.tech/project/dicklesworthstone-llm-aided-ocr.html)
Mesuré à partir des topics GitHub communs aux deux projets, pondérés par leur rareté.