Skip to main content
POST
Extraire des données structurées à partir de pages grâce aux LLM
Êtes-vous un agent d’IA ayant besoin d’une clé API Firecrawl ? Consultez firecrawl.dev/agent-onboarding/SKILL.md pour obtenir des instructions d’intégration automatisée.

Autorisations

Authorization
string
header
requis

Bearer authentication header of the form Bearer <token>, where <token> is your auth token.

Corps

application/json
urls
string<uri>[]
requis

Les URL à partir desquelles extraire les données. Les URL doivent être au format glob.

Lorsque ce paramètre est défini sur true, l’extraction utilisera la recherche web pour trouver des données supplémentaires

ignoreInvalidURLs
boolean
défaut:true

Si des URL invalides sont spécifiées dans le tableau urls, elles seront ignorées. Plutôt que de faire échouer l’intégralité de la requête, une extraction sera effectuée en utilisant les URL valides restantes, et les URL invalides seront renvoyées dans le champ invalidURLs de la réponse.

ignoreSitemap
boolean
défaut:false

Lorsque cette option est activée, les fichiers sitemap.xml sont ignorés lors de l’analyse du site web

includeSubdomains
boolean
défaut:true

Lorsque cette option est activée, les sous-domaines des URL fournies sont également analysés

prompt
string

Prompt pour orienter le processus d’extraction

schema
object

Schéma définissant la structure des données extraites. Doit être conforme à JSON Schema.

scrapeOptions
object
showSources
boolean
défaut:false

Lorsque la valeur est true, les sources utilisées pour extraire les données sont incluses dans la réponse sous la clé sources.

threatProtection
Threat Protection Override · object

Dérogation Protection contre les menaces au niveau de la requête. Les champs que vous fournissez remplacent les champs correspondants de la politique de votre organisation pour cette requête uniquement ; les champs omis conservent leurs valeurs définies au niveau de l'organisation. La Protection contre les menaces doit être activée pour votre équipe (fonctionnalité Enterprise) ; sinon, la requête est rejetée avec un code 403. Si votre organisation a désactivé les dérogations par requête, toute requête qui inclut cet objet est rejetée avec un code 403. Si la Protection contre les menaces est appliquée à votre équipe, mode ne peut pas être défini sur off.

Réponse

Extraction réussie

id
string
invalidURLs
string[] | null

Si ignoreInvalidURLs vaut true, ce champ est un tableau contenant les URL non valides qui ont été spécifiées dans la requête. S’il n’y a aucune URL non valide, ce sera un tableau vide. Si ignoreInvalidURLs vaut false, ce champ sera undefined.

success
boolean