Repositorio oficial para "Craw4LLM: Rastreo Web Eficiente para Preentrenamiento de LLM"
Configura un rastreador web para recopilar datos para entrenar modelos de lenguaje grande de manera eficiente.
Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.
Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.
Gratis · sin tarjeta · cancela cuando quierasRepositorio oficial para "Craw4LLM: Rastreo Web Eficiente para Preentrenamiento de LLM"
Craw4LLM tiene 660 estrellas en GitHub. Se ha bifurcado 60 veces. Craw4LLM está escrito principalmente en Python. Se desarrolla activamente desde 2025. Craw4LLM está disponible bajo la licencia MIT. Sus temas principales son: crawler, crawling, large-language-models, llm.
Repositorio oficial para "Craw4LLM: Rastreo Web Eficiente para Preentrenamiento de LLM"
Craw4LLM es un proyecto de código abierto. Se distribuye bajo la licencia MIT.
Sí. Craw4LLM es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.
Craw4LLM está disponible bajo la licencia MIT.
Craw4LLM está escrito principalmente en Python.
Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.
[](https://opensourceai.tech/project/cxcscmu-craw4llm.html)
Medido a partir de los topics de GitHub comunes a ambos proyectos, ponderados por su rareza.