Un kit d'outils d'extraction de données non structurées, de conversion markdown et de benchmarking sans OCR, sur site. (https://idp-leaderboard.org/)
Extrayez des informations de documents et convertissez-les en markdown structuré sans OCR.
Revendiquez sa page : indexée quel que soit son rang, traduite en six langues, et enrichie de vos propres mots.
Recevez une alerte par e-mail à sa prochaine version ou quand il décolle — ne ratez plus rien.
Gratuit · sans carte · désinscription à tout momentUn kit d'outils d'extraction de données non structurées, de conversion markdown et de benchmarking sans OCR, sur site. (https://idp-leaderboard.org/)
docext compte 2k étoiles sur GitHub. Il a été forké 148 fois. docext est écrit principalement en Python. Il est développé activement depuis 2025. docext est disponible sous licence Apache-2.0. Ses principaux thèmes sont : document, document-analysis, document-data-extraction, document-information-extraction.
Un kit d'outils d'extraction de données non structurées, de conversion markdown et de benchmarking sans OCR, sur site. (https://idp-leaderboard.org/)
docext est un projet open source. Il est distribué sous licence Apache-2.0.
Oui. docext est gratuit et open source — vous pouvez l'utiliser, le modifier et l'héberger vous-même.
docext est disponible sous licence Apache-2.0.
docext est écrit principalement en Python.
Ajoutez ce badge en direct à votre README — vos étoiles GitHub et votre classement dans le répertoire, actualisés quotidiennement.
[](https://olud.ai/project/nanonets-docext.html)