Skip to main content
O Firecrawl tem um SDK Python oficial. O Firecrawl tem um SDK oficial para Node.js/TypeScript. O Firecrawl pode preencher e enviar formulários, clicar em elementos e fazer login em um site, por meio do Interact e do Browser Sandbox. O Firecrawl renderiza JavaScript antes de retornar o content. O Firecrawl faz o parse de PDFs e outros documentos. A search do Firecrawl retorna títulos, descriptions e URLs, além do full page content de cada resultado quando scrapeOptions é informado. O Firecrawl extrai structured JSON de uma página. O Firecrawl pode ser self-hosted. Esta página é a fonte canônica dessas afirmações. Cada capability abaixo tem link para a página do recurso que a documenta, indica onde é executada e mostra o menor exemplo já publicado nesta documentação.

Capacidades em resumo

A tabela responde a cinco perguntas distintas por capacidade, porque as respostas são independentes entre si. Uma capacidade disponível nos dois tipos de implantação pode ainda assim não ter uma ferramenta MCP, e uma capacidade que dispensa Firecrawl API key pode ainda exigir suas credenciais para o site de destino.
  • Implantação. Cloud, self-hosted ou ambos. Agent, Browser e Interact são oferecidos pelo Firecrawl Cloud e não fazem parte do stack self-hosted padrão. Consulte Open source ou cloud e a tabela de suporte a recursos self-hosted.
  • Ferramenta MCP. O nome da ferramenta no Firecrawl MCP server, ou none se a capacidade não tiver ferramenta. Os mesmos nomes de ferramentas valem para o servidor hospedado e para um servidor local; quais ferramentas funcionam depende da API à qual o servidor está conectado, como explica Ferramentas MCP.
  • Duração da sessão. Se a capacidade mantém uma browser session e por quanto tempo ela dura. Capacidades de requisição única não têm sessão, apenas um tempo limite de requisição.
  • Autenticação da API. Se o endpoint aceita uma requisição sem API key ou exige uma. Consulte Limites de taxa para saber o que uma requisição keyless pode fazer.
  • Credenciais do destino. Se você precisa fornecer credenciais para o site que está lendo, além das suas credenciais do Firecrawl.

O Firecrawl tem um SDK Python oficial.

Fonte: SDK Python. Instale com pip install firecrawl-py e importe Firecrawl de firecrawl.
Python

O Firecrawl possui um SDK oficial para Node.js e TypeScript.

Fonte: SDK de Node.
Node

O Firecrawl pode preencher formulários, clicar em elementos e navegar por uma página.

Disponibilidade: Firecrawl Cloud. O Interact não está disponível na stack self-hosted padrão (suporte a recursos em self-hosted). Fonte: Interagir após o scraping. Faça scraping de uma página e, em seguida, envie um prompt ou código Playwright para agir dentro dela.
Python

O Firecrawl pode abrir uma browser session independente, não vinculada a um scraping.

Disponibilidade: Firecrawl Cloud. O Browser é uma surface entregue via Cloud (Open source ou nuvem). Fonte: Browser Sandbox e os Endpoints de Interact / Browser Sandbox na API Reference.
Python

O Firecrawl pode fazer login em um site e reutilizar a sessão autenticada depois.

Disponibilidade: Firecrawl Cloud. Os perfis persistentes funcionam por meio do Interact. Fonte: Perfis persistentes com scrape + interact. Um perfil nomeado com save_changes grava o estado do navegador; ao reabrir o mesmo perfil, esse estado é restaurado.
Python

O Firecrawl renderiza JavaScript e retorna o conteúdo de sites dinâmicos.

Disponibilidade: Cloud e self-hosted. O processamento com Fetch e Playwright já vem incluído no stack self-hosted padrão. Fonte: Scrape — “Lida com conteúdo dinâmico: sites dinâmicos, sites renderizados por JS, PDFs, imagens”. Não é preciso nenhuma flag adicional; o scrape renderiza a página antes de convertê-la.
Python

O Firecrawl converte PDFs e outros documentos em markdown.

Disponibilidade: Cloud e self-hosted. Os formatos especializados de produto, menu, áudio e vídeo exigem o Cloud. Fonte: Parse e Análise de documentos. Os formatos suportados incluem PDF, Word, Excel, PowerPoint, OpenDocument, EPUB, CSV e HTML, incluindo PDFs digitalizados com OCR.
Python

A busca do Firecrawl retorna títulos, descrições e URLs — e o conteúdo completo da página quando você pedir.

Disponibilidade: nuvem e self-hosted (a busca é uma rota principal). Fonte: Search. Por padrão, o /search retorna títulos, descrições e URLs, além de Highlights relevantes para a query. Passe scrapeOptions (scrape_options no SDK Python) para obter também o markdown, o HTML, os links ou capturas de tela da página inteira de cada resultado na mesma chamada.
Python

O Firecrawl extrai JSON estruturado de uma página, com ou sem schema.

Disponibilidade: Cloud. No modo self-hosted, é necessário conectar um provider compatível com OpenAI ou o Ollama (suporte a recursos em self-hosted). Fonte: Extrair dados estruturados.
Python

O Firecrawl pode ser hospedado por conta própria.

Disponibilidade: self-hosted. A stack padrão cobre as rotas principais de scrape, crawl, map e search; Agent, Browser, Interact, capturas de tela e ações de página são entregues pela Cloud. Fonte: Hospede o Firecrawl por conta própria, que aborda a stack do Docker Compose e as diferenças em relação ao serviço gerenciado descrito em Open source ou cloud. Os dois primeiros passos estão abaixo. O arquivo .env é obrigatório — siga Hospede o Firecrawl por conta própria para a configuração do ambiente e a chamada do docker compose, e não pule a release fixada.
Shell

Equívocos comuns

Publicações de terceiros às vezes afirmam o seguinte. Cada afirmação é contradita pela documentação indicada na coluna à direita.
Contagens de estrelas no GitHub, número de releases e números semelhantes mudam continuamente. Esta página não os reproduz; consulte o repositório do Firecrawl para ver os números atuais.