Outils disponibles
1. outil de scraping (firecrawl_scrape)
redactPII dans les arguments de l’outil de scrape.
2. Outil de cartographie (firecrawl_map)
Options de l’outil de cartographie :
url: URL de base du site web à cartographiersearch: Terme de recherche facultatif pour filtrer les URLsitemap: Contrôle l’utilisation du sitemap : « include », « skip » ou « only »includeSubdomains: Indique s’il faut inclure les sous-domaines dans la cartographielimit: Nombre maximal d’URL à renvoyerignoreQueryParameters: Indique s’il faut ignorer les paramètres de requête lors de la cartographie
3. Outil de recherche (firecrawl_search)
Options de l’outil de recherche :
query: Chaîne de requête de recherche (obligatoire)limit: Nombre maximal de résultats à renvoyerlocation: Emplacement géographique des résultats de recherchetbs: Filtre de recherche temporel (par exemple,qdr:dpour le dernier jour,qdr:wpour la dernière semaine,qdr:mpour le dernier mois)filter: Filtre de recherche supplémentairesources: Tableau des types de sources dans lesquels effectuer la recherche (web,images,news)scrapeOptions: Options de scraping des pages de résultats de rechercheenterprise: Tableau d’options d’entreprise (default,anon,zdr)
4. Outil de parsing (firecrawl_parse)
FIRECRAWL_API_URL, le serveur MCP peut lire directement filePath et envoie les octets du fichier à /v2/parse.
Lorsque vous utilisez le serveur MCP hébergé à distance, il ne peut pas lire les fichiers présents sur votre machine. Dans ce cas, firecrawl_parse utilise un transfert en deux étapes qui fonctionne également avec l’URL distante sans clé :
- Appelez
firecrawl_parseavecfilePath. L’outil renvoie une commande de téléversement préremplie et unnextToolCallcontenant uneuploadRef. - Exécutez la commande de téléversement sur la machine qui peut lire le fichier, puis appelez de nouveau
firecrawl_parseavec l’uploadRefrenvoyée.
Options de l’outil de parsing :
filePath: Chemin local du fichier à analyser. À utiliser lors du premier appel.uploadRef: Référence renvoyée par le premier appel MCP hébergé. À utiliser lors du deuxième appel, une fois le téléversement terminé.formats: Formats de sortie. La valeur par défaut estmarkdown.parsers: Paramètres du parseur, tels que les options de parsing des PDF.contentType: Remplacement facultatif du type MIME du fichier.declaredSizeBytes: Indication facultative de la taille du fichier. La taille des fichiers est limitée à 50 Mo.
firecrawl_scrape : il détecte et analyse les documents à partir de leurs URL.
5. Outil de crawl (firecrawl_crawl)
6. Vérifier l’état d’un crawl (firecrawl_check_crawl_status)
7. Outil Extract (firecrawl_extract)
Options de l’outil Extract :
urls: tableau d’URL à partir desquelles extraire des informationsprompt: prompt personnalisé pour l’extraction par le LLMschema: schéma JSON pour l’extraction de données structuréesallowExternalLinks: autoriser l’extraction depuis des liens externesenableWebSearch: activer la recherche web pour obtenir du contexte supplémentaireincludeSubdomains: inclure les sous-domaines dans l’extraction
8. Outil Agent (firecrawl_agent)
firecrawl_agent_status pour vérifier qu’il est terminé et récupérer les résultats.
Options de l’outil Agent :
prompt: Description en langage naturel des données souhaitées (obligatoire, 10 000 caractères maximum)urls: Tableau facultatif d’URL permettant de cibler l’agent sur des pages spécifiquesschema: Schéma JSON facultatif pour une sortie structurée
firecrawl_agent_status pour interroger les résultats.
9. Vérifier le statut de l’agent (firecrawl_agent_status)
Options de statut de l’agent :
id: l’ID de tâche d’agent renvoyé parfirecrawl_agent(obligatoire)
processing: l’agent effectue encore ses recherches — continuez à l’interrogercompleted: la recherche est terminée — la réponse contient les données extraitesfailed: une erreur s’est produite
10. Interagir avec une page (firecrawl_interact)
- Transmettez
urlpour ouvrir une nouvelle page et interagir avec elle en un seul appel MCP. - Transmettez le
scrapeIdd’un appelfirecrawl_scrapeprécédent pour réutiliser la page déjà chargée.
url et scrapeId. Fournissez soit prompt, soit code. scrapeOptions ne peut être utilisé qu’en mode url.
Exemple en mode URL :
Options de l’outil Interact :
url: Page avec laquelle interagir ; ouvre une session pour vous. Utilisez ce paramètre ouscrapeId.scrapeId: ID de tâche de scraping issu d’un appelfirecrawl_scrapeprécédent. Utilisez ce paramètre ouurl.prompt: Instruction en langage naturel décrivant l’action à effectuer. Fournissezpromptoucode.code: Code à exécuter dans la session de navigateur. Fournissezcodeouprompt.language:bash,pythonounode(facultatif,nodepar défaut, utilisé uniquement aveccode).timeout: Délai d’exécution en secondes, de 1 à 300 (facultatif, 30 par défaut).scrapeOptions: Options de scraping facultatives utilisées uniquement en modeurl.
11. Arrêter une session Interact (firecrawl_interact_stop)
Options d’arrêt d’une session Interact :
scrapeId: l’ID de scrape de la session à arrêter (obligatoire)
Système de journalisation
- État et progression des opérations
- Indicateurs de performance
- Surveillance de l’utilisation des crédits
- Suivi des limites de débit
- Conditions d’erreur
Gestion des erreurs
- Nouvelles tentatives automatiques en cas d’erreurs transitoires
- Gestion des limites de débit avec backoff exponentiel
- Messages d’erreur détaillés
- Avertissements sur l’utilisation des crédits
- Résilience du réseau

