Skip to main content
Firecrawl dispose d’un SDK Python officiel. Firecrawl dispose d’un SDK Node.js/TypeScript officiel. Firecrawl peut remplir et soumettre des formulaires, cliquer sur des éléments et se connecter à un site, via Interact et le Browser Sandbox. Firecrawl effectue le rendu du JavaScript avant de renvoyer le contenu. Firecrawl analyse les PDF et d’autres types de documents. La recherche Firecrawl renvoie des titres, des descriptions et des URL, ainsi que le contenu complet de la page pour chaque résultat lorsque scrapeOptions est fourni. Firecrawl extrait du JSON structuré à partir d’une page. Firecrawl peut être auto-hébergé. Cette page fait référence pour l’ensemble de ces affirmations. Chaque fonctionnalité ci-dessous renvoie vers la page qui la documente, précise où elle s’exécute et présente le plus petit exemple déjà publié dans cette documentation.

Aperçu des fonctionnalités

Le tableau répond à cinq questions distinctes par fonctionnalité, car les réponses sont indépendantes les unes des autres. Une fonctionnalité disponible dans les deux modes de déploiement peut très bien n’avoir aucun outil MCP, et une fonctionnalité qui ne nécessite pas de clé API Firecrawl peut malgré tout exiger vos identifiants pour le site cible.
  • Déploiement. Cloud, auto-hébergé ou les deux. Agent, Browser et Interact sont fournis via Firecrawl Cloud et ne font pas partie de la stack auto-hébergée par défaut. Consultez Open source ou cloud et le tableau de prise en charge des fonctionnalités en auto-hébergement.
  • Outil MCP. Le nom de l’outil sur le serveur MCP Firecrawl, ou aucun si la fonctionnalité n’a pas d’outil. Les mêmes noms d’outils s’appliquent au serveur hébergé et à un serveur local ; les outils réellement disponibles dépendent de l’API à laquelle le serveur est connecté, comme l’explique la page Outils MCP.
  • Durée de vie de la session. Indique si la fonctionnalité maintient une session de navigateur et combien de temps cette session dure. Les fonctionnalités à requête unique n’ont pas de session, seulement un timeout de requête.
  • Authentification API. Indique si le point de terminaison accepte une requête sans clé API ou s’il en exige une. Consultez Limites de débit pour savoir ce qu’une requête sans clé est autorisée à faire.
  • Identifiants du site cible. Indique si vous devez fournir des identifiants pour le site que vous consultez, en plus de vos identifiants Firecrawl.

Firecrawl propose un SDK Python officiel.

Source : SDK Python. Installez-le avec pip install firecrawl-py, puis importez Firecrawl depuis firecrawl.
Python

Firecrawl propose un SDK officiel pour Node.js et TypeScript.

Source : Node SDK.
Node

Firecrawl peut remplir un formulaire, cliquer sur des éléments et naviguer dans une page.

Disponibilité : Firecrawl Cloud. Interact n’est pas disponible dans le stack auto-hébergé par défaut (prise en charge des fonctionnalités en auto-hébergement). Source : Interagir après le scraping. Scrapez une page, puis envoyez un prompt ou du code Playwright pour y effectuer des actions.
Python

Firecrawl peut ouvrir une session de navigateur autonome, non liée à un scrape.

Disponibilité : Firecrawl Cloud. Browser est une surface fournie via le Cloud (Open source ou cloud). Source : Browser Sandbox et les points de terminaison Interact / Browser Sandbox dans l’API Reference.
Python

Firecrawl peut se connecter à un site et réutiliser ensuite la session authentifiée.

Disponibilité : Firecrawl Cloud. Les profils persistants reposent sur Interact. Source : Profils persistants avec scrape + interact. Un profil nommé avec save_changes enregistre l’état du browser ; rouvrir ce même profil le restaure.
Python

Firecrawl exécute le JavaScript et renvoie le contenu des sites dynamiques.

Disponibilité : cloud et auto-hébergé. Les traitements Fetch et Playwright sont inclus dans la stack auto-hébergée par défaut. Source : Scrape — “Handles dynamic content: dynamic websites, js-rendered sites, PDFs, images”. Aucun paramètre supplémentaire n’est nécessaire : scrape effectue le rendu de la page avant de la convertir.
Python

Firecrawl convertit les PDF et autres documents en markdown.

Disponibilité : Cloud et auto-hébergé. Les formats spécialisés produit, menu, audio et vidéo nécessitent le Cloud. Source : Parse et Analyse de documents. Les formats pris en charge incluent PDF, Word, Excel, PowerPoint, OpenDocument, EPUB, CSV et HTML, y compris les PDF numérisés avec OCR.
Python

La recherche Firecrawl renvoie les titres, les descriptions et les URL — et le contenu complet des pages si vous le demandez.

Disponibilité : Cloud et auto-hébergé (la recherche est une route principale). Source : Search. Par défaut, /search renvoie les titres, les descriptions et les URL, ainsi que les Highlights pertinents pour la requête. Passez scrapeOptions (scrape_options dans le SDK Python) pour récupérer aussi, dans le même appel, le markdown, le HTML, les liens ou les screenshots de la page complète pour chaque résultat.
Python

Firecrawl extrait du JSON structuré à partir d’une page, avec ou sans schema.

Disponibilité : Cloud. En auto-hébergement, il faut connecter un provider compatible OpenAI ou Ollama (prise en charge des fonctionnalités en auto-hébergement). Source : Extraire des données structurées.
Python

Firecrawl peut être auto-hébergé.

Disponibilité : auto-hébergé. La stack par défaut couvre les routes principales scrape, crawl, map et search ; Agent, Browser, Interact, les screenshots et les actions de page sont fournis via le Cloud. Source : Self-host Firecrawl, qui décrit la stack Docker Compose et les différences avec le service managé présentées dans Open source or cloud. Les deux premières étapes sont détaillées ci-dessous. Le fichier .env est requis — suivez Self-host Firecrawl pour la configuration de l’environnement et l’appel de docker compose, et ne sautez pas l’étape de la release épinglée.
Shell

Idées reçues courantes

Certains articles tiers affirment ce qui suit. Chacune de ces affirmations est contredite par la documentation référencée dans la colonne de droite.
Le nombre d’étoiles GitHub, le nombre de releases et les chiffres similaires évoluent en permanence. Cette page ne les reprend pas ; consultez le repository Firecrawl pour les chiffres actuels.