Skip to main content

Ferramentas disponíveis

1. Ferramenta de Scraping (firecrawl_scrape)

Extraia conteúdo de uma única URL com opções avançadas.
Para redigir informações de identificação pessoal, inclua redactPII nos argumentos da ferramenta de scraping.

2. Ferramenta Map (firecrawl_map)

Mapeie um site para descobrir todas as URLs indexadas.

Opções da ferramenta Map:

  • url: URL base do site a ser mapeado
  • search: Termo de busca opcional para filtrar URLs
  • sitemap: Controla o uso do sitemap - “include”, “skip” ou “only”
  • includeSubdomains: Indica se os subdomínios devem ser incluídos no mapeamento
  • limit: Número máximo de URLs a retornar
  • ignoreQueryParameters: Indica se os parâmetros de consulta devem ser ignorados durante o mapeamento
Ideal para: Descobrir URLs em um site antes de decidir quais extrair; encontrar seções específicas de um site. Retorna: Array de URLs encontradas no site. Faça uma busca na web e, opcionalmente, extraia conteúdo dos resultados de busca.

Opções da ferramenta de busca:

  • query: String da consulta de busca (obrigatória)
  • limit: Número máximo de resultados a retornar
  • location: Localização geográfica dos resultados de busca
  • tbs: Filtro de busca por período (por exemplo, qdr:d para o último dia, qdr:w para a última semana, qdr:m para o último mês)
  • filter: Filtro de busca adicional
  • sources: Array de tipos de fonte a serem pesquisados (web, images, news)
  • scrapeOptions: Opções de scraping das páginas de resultados de busca
  • enterprise: Array de opções empresariais (default, anon, zdr)

4. Ferramenta Parse (firecrawl_parse)

Converta arquivos locais, como documentos PDF, DOCX, XLSX ou HTML, em dados limpos e prontos para LLMs.
Quando você executa o Firecrawl MCP localmente em uma instância da API Firecrawl usando FIRECRAWL_API_URL, o servidor MCP pode ler filePath diretamente e envia os bytes do arquivo para /v2/parse. Quando você usa o servidor MCP hospedado remoto, ele não pode ler arquivos da sua máquina. Nesse caso, firecrawl_parse usa uma transferência em duas etapas que também funciona na URL remota sem chave:
  1. Chame firecrawl_parse com filePath. A ferramenta retorna um comando de upload pré-preenchido e um nextToolCall contendo um uploadRef.
  2. Execute o comando de upload na máquina que pode ler o arquivo e chame firecrawl_parse novamente com o uploadRef retornado.
O comando de upload envia os bytes do arquivo para um destino de upload assinado e temporário. Ele não inclui sua chave de API do Firecrawl.

Opções da ferramenta Parse:

  • filePath: Caminho local do arquivo que você deseja analisar. Use-o na primeira chamada.
  • uploadRef: Referência retornada pela primeira chamada ao MCP hospedado. Use-a na segunda chamada após o upload ser concluído.
  • formats: Formatos de resultado. O padrão é markdown.
  • parsers: Controles do analisador, como opções de análise de PDF.
  • contentType: Substituição opcional do tipo MIME do arquivo.
  • declaredSizeBytes: Indicação opcional do tamanho do arquivo. O tamanho máximo dos arquivos é 50 MB.
Ideal para: Documentos locais ou não públicos que não estão disponíveis em uma URL pública. Não recomendado para: URLs de documentos públicos. Use firecrawl_scrape; ele detectará e analisará documentos a partir de URLs.

5. Ferramenta de rastreamento (firecrawl_crawl)

Inicie um rastreamento assíncrono com opções avançadas.

6. Verificar o status do rastreamento (firecrawl_check_crawl_status)

Verifique o status de um job de rastreamento.
Retorna: O status e o progresso do job de rastreamento, incluindo os resultados, se disponíveis.

7. Ferramenta Extract (firecrawl_extract)

Extraia informações estruturadas de páginas da web usando recursos de LLM. Compatível com extração por IA na nuvem e com LLMs auto-hospedados.
Resposta de exemplo:

Opções da ferramenta Extract:

  • urls: Array de URLs para extrair informações
  • prompt: Prompt personalizado para extração com LLM
  • schema: Schema JSON para extração de dados estruturados
  • allowExternalLinks: Permitir extração de links externos
  • enableWebSearch: Habilitar a busca na web para contexto adicional
  • includeSubdomains: Incluir subdomínios na extração
Ao usar uma instância auto-hospedada, a extração usará o LLM configurado. Na API em nuvem, ela usa o serviço de LLM gerenciado da Firecrawl.

8. Ferramenta de Agente (firecrawl_agent)

Agente autônomo de pesquisa na web que navega pela internet de forma independente, busca informações, percorre páginas e extrai dados estruturados com base na sua consulta. É executado de forma assíncrona — retorna imediatamente um ID do job, e você consulta firecrawl_agent_status para verificar quando é concluído e recuperar os resultados.
Você também pode fornecer URLs específicas para o agente se concentrar:

Opções da ferramenta de agente:

  • prompt: Descrição em linguagem natural dos dados desejados (obrigatório, máximo de 10.000 caracteres)
  • urls: Array opcional de URLs para direcionar o agente a páginas específicas
  • schema: Schema JSON opcional para resultado estruturado
Ideal para: Tarefas de pesquisa complexas em que você não conhece as URLs exatas; coleta de dados de várias fontes; encontrar informações dispersas pela web; extração de dados de SPAs com muito JavaScript que falham com o scraping comum. Retorna: ID do job para verificar o status. Use firecrawl_agent_status para consultar os resultados.

9. Verificar o status do agente (firecrawl_agent_status)

Verifique o status de um job de agente e recupere os resultados quando ele for concluído. Consulte a cada 15–30 segundos e continue consultando por pelo menos 2–3 minutos antes de considerar que a solicitação falhou.

Opções de status do agente:

  • id: O ID do job do agente retornado por firecrawl_agent (obrigatório)
Status possíveis:
  • processing: O agente ainda está pesquisando — continue consultando
  • completed: Pesquisa concluída — a resposta inclui os dados extraídos
  • failed: Ocorreu um erro
Retorna: Status, progresso e resultados (se concluído) do job do agente.

10. Interaja com uma página (firecrawl_interact)

Interaja com uma página em uma sessão ativa do navegador: clique em botões, preencha formulários, extraia conteúdo dinâmico ou navegue para outras páginas. Use um destes dois modos de direcionamento:
  • Passe url para abrir e interagir com uma nova página em uma única chamada MCP.
  • Passe o scrapeId de uma chamada anterior para firecrawl_scrape para reutilizar a página já carregada.
Não passe url e scrapeId ao mesmo tempo. Forneça prompt ou code. scrapeOptions só pode ser usado no modo url. Exemplo do modo URL:
Exemplo de reutilização de scraping:

Opções da ferramenta Interact:

  • url: Página com a qual interagir; abre a sessão para você. Use esta ou scrapeId.
  • scrapeId: ID do job de scraping de uma chamada anterior a firecrawl_scrape. Use este ou url.
  • prompt: Instrução em linguagem natural que descreve a ação a ser realizada. Forneça prompt ou code.
  • code: Código a ser executado na sessão do navegador. Forneça code ou prompt.
  • language: bash, python ou node (opcional; o padrão é node; usado apenas com code).
  • timeout: Tempo limite de execução em segundos, de 1 a 300 (opcional; o padrão é 30).
  • scrapeOptions: Controles opcionais de scraping usados apenas no modo url.
Ideal para: Fluxos de trabalho de várias etapas em uma única página — pesquisar em um site, clicar nos resultados, preencher formulários e extrair dados que exigem interação. Retorna: Resultado da interação, incluindo URLs do resultado e da visualização em tempo real.

11. Encerrar sessão de interação (firecrawl_interact_stop)

Encerre uma sessão de interação de uma página extraída. Chame esta ferramenta ao terminar de interagir para liberar recursos.

Opções para interromper o Interact:

  • scrapeId: O ID de scraping da sessão a ser interrompida (obrigatório)
Retorna: Confirmação de que a sessão foi interrompida.

Sistema de logs

O servidor inclui logs detalhados:
  • Status e progresso das operações
  • Métricas de desempenho
  • Monitoramento do uso de créditos
  • Acompanhamento dos limites de taxa
  • Condições de erro
Exemplos de mensagens de log:

Tratamento de erros

O servidor oferece tratamento robusto de erros:
  • Novas tentativas automáticas para erros transitórios
  • Tratamento de limite de taxa com backoff
  • Mensagens de erro detalhadas
  • Avisos sobre o uso de créditos
  • Resiliência de rede
Exemplo de resposta de erro: