Skip to main content

Visión general

Mejoras clave

  • Más rápido de forma predeterminada: Las solicitudes se almacenan en caché con maxAge establecido por defecto en 2 días, y están habilitados valores predeterminados sensatos como blockAds, skipTlsVerification y removeBase64Images.
  • Nuevo formato de resumen: Ahora puedes especificar "summary" como formato para recibir directamente un resumen conciso del contenido de la página.
  • Extracción JSON actualizada: La extracción en JSON y el seguimiento de cambios ahora usan un formato de objeto: { type: "json", prompt, schema }. El antiguo formato "extract" pasó a llamarse "json".
  • Opciones de captura de pantalla mejoradas: Usa el formato de objeto: { type: "screenshot", fullPage, quality, viewport }.
  • Nuevas fuentes de búsqueda: Busca en "news" e "images", además de los resultados web, configurando el parámetro sources.
  • Rastreo inteligente con prompts: Pasa un prompt en lenguaje natural para el rastreo y el sistema derivará rutas y límites automáticamente. Usa el nuevo punto de conexión /crawl/params-preview para inspeccionar las opciones derivadas antes de iniciar un trabajo.

Lista rápida de verificación de migración

  • Reemplaza el uso del cliente v1 por los clientes v2:
    • JS: const firecrawl = new Firecrawl({ apiKey: 'fc-YOUR-API-KEY' })
    • Python: firecrawl = Firecrawl(api_key='fc-YOUR-API-KEY')
    • API: usa los nuevos puntos de conexión https://api.firecrawl.dev/v2/.
  • Actualiza los formatos:
    • Usa "summary" cuando sea necesario
    • modo JSON: usa { type: "json", prompt, schema } para la extracción en modo JSON
    • Screenshot y Screenshot@fullPage: usa el formato de objeto de captura de pantalla al especificar opciones
  • Adopta flujos asíncronos estandarizados en los SDK:
    • Crawls: startCrawl + getCrawlStatus (o el “waiter” crawl)
    • Batch: startBatchScrape + getBatchScrapeStatus (o el “waiter” batchScrape)
    • Extract: startExtract + getExtractStatus (o el “waiter” extract)
  • Mapeo de opciones de crawl (ver abajo)
  • Verifica el prompt de crawl con /crawl/params-preview

Superficie del SDK (v2)

JS/TS

Cambios en los nombres de métodos (migración v1 → v2)

Scrape, Search y Map Crawling Batch Scraping Extraction Otros / Eliminados

Python (sincrónico)

Cambios en los nombres de métodos (migración v1 → v2)

Scrape, Search y Map Crawling Batch Scraping Extraction Otros / Eliminados

Python (async)

  • AsyncFirecrawl ofrece los mismos métodos (todos awaitable).

Formatos y opciones de scrape

  • Usa formatos de texto para lo básico: "markdown", "html", "rawHtml", "links", "summary", "images".
  • En lugar de parsePDF, usa parsers: [ { "type": "pdf" } | "pdf" ].
  • Usa formatos de objeto para JSON, seguimiento de cambios y capturas de pantalla:

Formato JSON

Formato de captura de pantalla

Mapeo de opciones de rastreo (v1 → v2)

Vista previa de prompt y parámetros de rastreo

Consulta ejemplos de la vista previa de parámetros de rastreo: