Repository ufficiale per "Craw4LLM: Efficient Web Crawling for LLM Pretraining"
Imposta un web crawler per raccogliere dati per addestrare modelli di linguaggio di grandi dimensioni in modo efficiente.
Rivendica la sua pagina: indicizzata qualunque sia il rango, tradotta in sei lingue e arricchita con le tue parole.
Ricevi un avviso via email alla prossima release o quando decolla — non perderti nulla.
Gratis · senza carta · disdici quando vuoiRepository ufficiale per "Craw4LLM: Efficient Web Crawling for LLM Pretraining"
Craw4LLM ha 660 stelle su GitHub. È stato forkato 60 volte. Craw4LLM è scritto principalmente in Python. È in sviluppo attivo dal 2025. Craw4LLM è disponibile con licenza MIT. I suoi temi principali sono: crawler, crawling, large-language-models, llm.
Repository ufficiale per "Craw4LLM: Efficient Web Crawling for LLM Pretraining"
Craw4LLM è un progetto open source. È rilasciato con licenza MIT.
Sì. Craw4LLM è gratuito e open source: puoi usarlo, modificarlo e ospitarlo autonomamente.
Craw4LLM è disponibile con licenza MIT.
Craw4LLM è scritto principalmente in Python.
Aggiungi questo badge live al tuo README — le tue stelle GitHub e il ranking della directory, aggiornati quotidianamente.
[](https://opensourceai.tech/project/cxcscmu-craw4llm.html)
Misurato dai topic GitHub comuni a entrambi i progetti, ponderati per la loro rarita.