- Funciona como
/crawlpero para una lista explícita de URL - Modos síncrono y asíncrono
- Compatible con todas las opciones de raspado, incluida la extracción estructurada
- Concurrencia configurable por trabajo
Operaciones
Cómo funciona
Puedes ejecutar un scrape por lotes de dos maneras:Uso básico
Respuesta
InvocarbatchScrape / batch_scrape devuelve los resultados completos cuando el lote finaliza.
Completado
startBatchScrape / start_batch_scrape devuelve un ID de tarea que puedes monitorear mediante getBatchScrapeStatus / get_batch_scrape_status, el endpoint de la API /batch/scrape/{id} o webhooks. Los resultados de la tarea están disponibles a través de la API durante 24 horas después de su finalización. Después de este período, aún puedes ver el historial y los resultados de tus ejecuciones de batch scrape en los activity logs.
Concurrencia
De forma predeterminada, un trabajo de extracción por lotes usa todo el límite de navegadores concurrentes de tu equipo (consulta Rate Limits). Puedes reducir este valor por trabajo con el parámetromaxConcurrency.
Por ejemplo, maxConcurrency: 50 limita ese trabajo a 50 extracciones simultáneas. Establecer este valor demasiado bajo en lotes grandes ralentizará significativamente el procesamiento, así que solo redúcelo si necesitas dejar capacidad para otros trabajos concurrentes.
Extracción estructurada
Puedes usar el raspado por lotes para extraer datos estructurados de cada página del lote. Esto es útil si quieres aplicar el mismo esquema a una lista de URL.Respuesta
batchScrape / batch_scrape devuelve resultados completos:
Completado
startBatchScrape / start_batch_scrape devuelve un ID de tarea:
Webhooks
Puedes configurar webhooks para recibir notificaciones en tiempo real a medida que se rastrea cada URL de tu lote. Esto te permite procesar los resultados de inmediato en lugar de esperar a que finalice todo el lote.cURL
Tipos de eventos
Carga útil
Cada entrega de webhook incluye un cuerpo JSON con la siguiente estructura:Verificación de firmas de webhooks
Cada solicitud de webhook de Firecrawl incluye un encabezadoX-Firecrawl-Signature que contiene una firma HMAC-SHA256. Verifica siempre esta firma para asegurarte de que el webhook sea auténtico y no haya sido manipulado.
- Obtén tu secreto de webhook en la pestaña Advanced de la configuración de tu cuenta
- Extrae la firma del encabezado
X-Firecrawl-Signature - Calcula el HMAC-SHA256 del cuerpo sin procesar de la solicitud usando tu secreto
- Compáralo con el encabezado de firma utilizando una función segura frente a ataques de temporización
¿Eres un agente de IA que necesita una clave de API de Firecrawl? Consulta firecrawl.dev/agent-onboarding/SKILL.md para obtener instrucciones de incorporación automatizada.

