Saltar al contenido principal

Requisitos previos

  • Una cuenta de AWS con acceso a Lambda
  • Una clave de la API de Firecrawl — obtén una gratis

Configuración

Buscar en la web

Crea el archivo index.mjs con un manejador de búsqueda:

Hacer scraping de una página

Agrega una acción scrape al mismo manejador:

Interactuar con una página

Agrega una acción interact para controlar una sesión activa del navegador: haz clic en botones, rellena formularios y extrae contenido dinámico:

Desplegar

Empaqueta y despliega con la AWS CLI:
Establece el timeout de Lambda en al menos 30 segundos. El scraping de páginas dinámicas y las sesiones de interactuar pueden tardar más que el timeout predeterminado de 3 segundos.

Próximos pasos

Documentación de búsqueda

Buscar en la web y obtener el contenido completo de la página

Documentación de scraping

Todas las opciones de scraping, incluidos los formatos, las acciones y los proxies

Documentación de interacción

Haz clic, completa formularios y extrae contenido dinámico

Referencia del SDK de Node

Referencia completa del SDK con rastreo, mapeo, extracción por lotes y más