Crawlee—Una biblioteca de scraping web y automatización de navegador para Node.js para construir crawlers confiables. En JavaScript y TypeScript. Extrae datos para IA, LLMs, RAG o GPTs. Descarga HTML, PDF, JPG, PNG y otros archivos de sitios web. Funciona con Puppeteer, Playwright.
Construya raspadores web para recopilar datos de sitios web y automatizar tareas del navegador.
Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.
Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.
Gratis · sin tarjeta · cancela cuando quierasCrawlee—Una biblioteca de scraping web y automatización de navegador para Node.js para construir crawlers confiables. En JavaScript y TypeScript. Extrae datos para IA, LLMs, RAG o GPTs. Descarga HTML, PDF, JPG, PNG y otros archivos de sitios web. Funciona con Puppeteer, Playwright.
crawlee tiene 25.1k estrellas en GitHub. Se ha bifurcado 1.6k veces. crawlee está escrito principalmente en TypeScript. Se desarrolla activamente desde 2016. crawlee está disponible bajo la licencia Apache-2.0. Sus temas principales son: apify, automation, crawler, crawling.
Crawlee—Una biblioteca de scraping web y automatización de navegador para Node.js para construir crawlers confiables. En JavaScript y TypeScript. Extrae datos para IA, LLMs, RAG o GPTs. Descarga HTML, PDF, JPG, PNG y otros archivos de sitios web. Funciona con Puppeteer, Playwright.
crawlee es un proyecto de código abierto. Se distribuye bajo la licencia Apache-2.0.
Sí. crawlee es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.
crawlee está disponible bajo la licencia Apache-2.0.
crawlee está escrito principalmente en TypeScript.
Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.
[](https://opensourceai.tech/project/apify-crawlee.html)
Medido a partir de los topics de GitHub comunes a ambos proyectos, ponderados por su rareza.