Toolkit per linearizzare PDF per set di dati/training LLM
Converti PDF e immagini in testo pulito e leggibile per addestrare modelli AI.
Rivendica la sua pagina: indicizzata qualunque sia il rango, tradotta in sei lingue e arricchita con le tue parole.
Ricevi un avviso via email alla prossima release o quando decolla — non perderti nulla.
Gratis · senza carta · disdici quando vuoiToolkit per linearizzare PDF per set di dati/training LLM
olmocr ha 19.2k stelle su GitHub. È stato forkato 1.6k volte. olmocr è scritto principalmente in Python. È in sviluppo attivo dal 2024. olmocr è disponibile con licenza Apache-2.0.
Read the full guideToolkit per linearizzare PDF per set di dati/training LLM
olmocr è un progetto open source. È rilasciato con licenza Apache-2.0.
Sì. olmocr è gratuito e open source: puoi usarlo, modificarlo e ospitarlo autonomamente.
olmocr è disponibile con licenza Apache-2.0.
olmocr è scritto principalmente in Python.
Aggiungi questo badge live al tuo README — le tue stelle GitHub e il ranking della directory, aggiornati quotidianamente.
[](https://opensourceai.tech/project/allenai-olmocr.html)