Requisitos previos
- Una cuenta de AWS con acceso a Lambda
- Una clave de la API de Firecrawl — obtén una gratis
Configuración
Buscar en la web
index.mjs con un manejador de búsqueda:
Hacer scraping de una página
scrape al mismo manejador:
Interactuar con una página
interact para controlar una sesión activa del navegador: haz clic en botones, rellena formularios y extrae contenido dinámico:
Desplegar
Establece el timeout de Lambda en al menos 30 segundos. El scraping de páginas dinámicas y las sesiones de interactuar pueden tardar más que el timeout predeterminado de 3 segundos.
Próximos pasos
Documentación de búsqueda
Buscar en la web y obtener el contenido completo de la página
Documentación de scraping
Todas las opciones de scraping, incluidos los formatos, las acciones y los proxies
Documentación de interacción
Haz clic, completa formularios y extrae contenido dinámico
Referencia del SDK de Node
Referencia completa del SDK con rastreo, mapeo, extracción por lotes y más

