Skip to main content

Présentation

Améliorations clés

  • Plus rapide par défaut : Les requêtes sont mises en cache avec maxAge fixé par défaut à 2 jours, et des paramètres pertinents comme blockAds, skipTlsVerification et removeBase64Images sont activés.
  • Nouveau format de résumé : Vous pouvez désormais indiquer "summary" comme format pour recevoir directement un résumé concis du contenu de la page.
  • Extraction JSON mise à jour : L’extraction JSON et le suivi des modifications utilisent désormais un format objet : { type: "json", prompt, schema }. L’ancien format "extract" a été renommé en "json".
  • Options de capture d’écran améliorées : Utilisez la forme objet : { type: "screenshot", fullPage, quality, viewport }.
  • Nouvelles sources de recherche : Recherchez dans "news" et "images", en plus des résultats web, en définissant le paramètre sources.
  • Crawl intelligent avec prompts : Fournissez un prompt en langage naturel au crawl et le système déduira automatiquement les chemins/limites. Utilisez le nouveau point de terminaison /crawl/params-preview pour prévisualiser les options dérivées avant de lancer un job.

Liste de contrôle de migration rapide

  • Remplacez l’utilisation du client v1 par les clients v2 :
    • JS : const firecrawl = new Firecrawl({ apiKey: 'fc-YOUR-API-KEY' })
    • Python : firecrawl = Firecrawl(api_key='fc-YOUR-API-KEY')
    • API : utilisez les nouveaux points de terminaison https://api.firecrawl.dev/v2/.
  • Mettez à jour les formats :
    • Utilisez "summary" si nécessaire
    • Mode JSON : utilisez { type: "json", prompt, schema } pour l’extraction JSON
    • Screenshot et Screenshot@fullPage : utilisez le format d’objet screenshot lors de la définition des options
  • Adoptez des flux asynchrones standardisés dans les SDK :
    • Crawls : startCrawl + getCrawlStatus (ou waiter crawl)
    • Batch : startBatchScrape + getBatchScrapeStatus (ou waiter batchScrape)
    • Extract : startExtract + getExtractStatus (ou waiter extract)
  • Correspondance des options de crawl (voir ci-dessous)
  • Vérifiez le prompt du crawl avec /crawl/params-preview

Surface du SDK (v2)

JS/TS

Changements de noms de méthodes (migration v1 → v2)

Scrape, Search et Map Crawling Batch Scraping Extraction Autres / Supprimés

Python (synchrones)

Changements de noms de méthodes (migration v1 → v2)

Scrape, Search et Map Crawling Batch Scraping Extraction Autres / Supprimées

Python (asynchrone)

  • AsyncFirecrawl propose les mêmes méthodes (toutes awaitables).

Formats et options de scraping

  • Utilisez des formats chaîne pour les bases : "markdown", "html", "rawHtml", "links", "summary", "images".
  • Au lieu de parsePDF, utilisez parsers: [ { "type": "pdf" } | "pdf" ].
  • Utilisez des formats objet pour JSON, le suivi des modifications et les captures d’écran :

Format JSON

Format de capture d’écran

Correspondance des options de crawl (v1 → v2)

Aperçu du prompt et des paramètres de crawl

Voir des exemples d’aperçu des paramètres de crawl :