Repositório oficial para "Craw4LLM: Web Crawling Eficiente para Pré-treinamento de LLM"
Configure um web crawler para coletar dados para treinar grandes modelos de linguagem de forma eficiente.
Reivindique a sua pagina: indexada seja qual for a posicao, traduzida em seis linguas e enriquecida com as suas palavras.
Receba um alerta por e-mail no próximo lançamento ou quando começar a bombar.
Grátis · sem cartão · cancele quando quiserRepositório oficial para "Craw4LLM: Web Crawling Eficiente para Pré-treinamento de LLM"
Craw4LLM tem 660 estrelas no GitHub. Foi bifurcado 60 vezes. Craw4LLM é escrito principalmente em Python. Está em desenvolvimento ativo desde 2025. Craw4LLM está disponível sob a licença MIT. Os seus principais temas são: crawler, crawling, large-language-models, llm.
Repositório oficial para "Craw4LLM: Web Crawling Eficiente para Pré-treinamento de LLM"
Craw4LLM é um projeto de código aberto. É distribuído sob a licença MIT.
Sim. Craw4LLM é gratuito e de código aberto — você pode usá-lo, modificá-lo e hospedá-lo por conta própria.
Craw4LLM está disponível sob a licença MIT.
Craw4LLM é escrito principalmente em Python.
Adicione este badge ao vivo ao seu README — suas estrelas do GitHub e classificação no diretório, atualizadas diariamente.
[](https://opensourceai.tech/project/cxcscmu-craw4llm.html)
Medido a partir dos topics do GitHub comuns aos dois projetos, ponderados pela sua raridade.