Kit de ferramentas para linearizar PDFs para conjuntos de dados/treinamento de LLM
Converta PDFs e imagens em texto limpo e legível para treinar modelos de IA.
Reivindique a sua pagina: indexada seja qual for a posicao, traduzida em seis linguas e enriquecida com as suas palavras.
Receba um alerta por e-mail no próximo lançamento ou quando começar a bombar.
Grátis · sem cartão · cancele quando quiserKit de ferramentas para linearizar PDFs para conjuntos de dados/treinamento de LLM
olmocr tem 19.2k estrelas no GitHub. Foi bifurcado 1.6k vezes. olmocr é escrito principalmente em Python. Está em desenvolvimento ativo desde 2024. olmocr está disponível sob a licença Apache-2.0.
Read the full guideKit de ferramentas para linearizar PDFs para conjuntos de dados/treinamento de LLM
olmocr é um projeto de código aberto. É distribuído sob a licença Apache-2.0.
Sim. olmocr é gratuito e de código aberto — você pode usá-lo, modificá-lo e hospedá-lo por conta própria.
olmocr está disponível sob a licença Apache-2.0.
olmocr é escrito principalmente em Python.
Adicione este badge ao vivo ao seu README — suas estrelas do GitHub e classificação no diretório, atualizadas diariamente.
[](https://opensourceai.tech/project/allenai-olmocr.html)