Skip to main content

Introdução ao Firecrawl e ao n8n

A automação de scraping web tornou-se essencial para empresas modernas. Seja para monitorar preços de concorrentes, agregar conteúdo, gerar leads ou alimentar aplicações de IA com dados em tempo real, a combinação do Firecrawl com o n8n oferece uma solução poderosa sem exigir conhecimentos de programação. Integração entre Firecrawl e n8n O que é o n8n? O n8n é uma plataforma de automação de fluxos de trabalho de código aberto que conecta diferentes ferramentas e serviços. Pense nele como um ambiente de programação visual no qual você arrasta e solta nós em um canvas, conecta-os e cria fluxos de trabalho automatizados. Com mais de 400 integrações, o n8n permite criar automações complexas sem escrever código.

Por que usar o Firecrawl com o n8n?

O scraping tradicional apresenta vários desafios. Scripts personalizados deixam de funcionar quando os sites alteram sua estrutura. Sistemas antibot bloqueiam solicitações automatizadas. Sites que dependem muito de JavaScript não são renderizados corretamente. A infraestrutura exige manutenção constante. O Firecrawl lida com essas complexidades técnicas relacionadas ao scraping, enquanto o n8n fornece a estrutura de automação. Juntos, eles permitem criar fluxos de trabalho prontos para produção que:
  • Extraem dados de qualquer site de forma confiável
  • Conectam dados extraídos a outras ferramentas de negócios
  • São executados conforme agendamentos ou acionados por eventos
  • Escalam de tarefas simples a pipelines complexos
Este guia mostrará como configurar as duas plataformas e criar seu primeiro fluxo de trabalho de scraping do zero.

Etapa 1: Crie sua conta no Firecrawl

O Firecrawl oferece recursos de scraping web para seus fluxos de trabalho. Vamos configurar sua conta e obter suas credenciais de API.

Cadastre-se no Firecrawl

  1. Acesse firecrawl.dev no navegador
  2. Clique no botão “Começar” ou “Cadastre-se”
  3. Crie uma conta usando seu endereço de e-mail ou login do GitHub
  4. Verifique seu e-mail, se solicitado

Obtenha sua chave de API

Após fazer login, você precisa de uma chave de API para conectar o Firecrawl ao n8n:
  1. Acesse o painel do Firecrawl
  2. Vá até a página de chaves de API
  3. Clique em “Create New API Key”
  4. Dê à chave um nome descritivo, como “Integração n8n”
  5. Copie a chave de API gerada e salve-a em um local seguro
Seção de chave de API do Firecrawl
Sua chave de API é como uma senha. Mantenha-a segura e nunca a compartilhe publicamente. Você precisará dela na próxima seção.
Ao se cadastrar, você recebe créditos gratuitos do Firecrawl, suficientes para testar seus fluxos de trabalho e concluir este tutorial.

Etapa 2: Configure o n8n

O n8n oferece duas opções de implantação: na nuvem ou auto-hospedado. Para iniciantes, a versão na nuvem é a forma mais rápida de começar.

Escolha sua versão do n8n

n8n Cloud (Recomendado para iniciantes):
  • Não requer instalação
  • Plano Free disponível
  • Infraestrutura gerenciada
  • Atualizações automáticas
Auto-hospedado:
  • Controle total sobre os dados
  • Execute em seus próprios servidores
  • Requer a instalação do Docker
  • Ideal para usuários avançados com requisitos específicos de segurança
Escolha a opção que melhor atende às suas necessidades. Ambas levam à mesma interface do editor de fluxo de trabalho.
  1. Acesse n8n.cloud
  2. Clique em “Começar grátis” ou “Cadastre-se”
  3. Cadastre-se com seu endereço de e-mail ou conta do GitHub
  4. Conclua o processo de verificação
  5. Você será direcionado ao painel do n8n
Página inicial do n8n Cloud mostrando as opções de cadastro O plano Free oferece tudo o que você precisa para criar e testar fluxos de trabalho. Você pode fazer upgrade depois se precisar de mais tempo de execução ou recursos avançados.

Opção B: Auto-hospedado com Docker

Se preferir executar o n8n na sua própria infraestrutura, você pode configurá-lo rapidamente com o Docker. Pré-requisitos:
  • Docker Desktop instalado no computador
  • Conhecimento básico de linha de comando/terminal
Etapas de instalação:
  1. Abra o terminal ou prompt de comando
  2. Crie um volume do Docker para persistir os dados do seu fluxo de trabalho:
Este volume armazena seus fluxos de trabalho, credenciais e histórico de execução para que persistam mesmo se você reiniciar o contêiner.
  1. Execute o contêiner Docker do n8n:
Terminal mostrando os comandos do Docker sendo executados enquanto o n8n é iniciado
  1. Aguarde o n8n iniciar. Você verá uma saída indicando que o servidor está em execução
  2. Abra o navegador e acesse http://localhost:5678
  3. Crie sua conta do n8n registrando-se com um e-mail
Tela de boas-vindas do n8n auto-hospedado em localhost:5678 Sua instância auto-hospedada do n8n agora está em execução localmente. A interface é idêntica à do n8n Cloud, então você pode seguir o restante deste guia independentemente da opção escolhida.
A flag --rm remove automaticamente o contêiner quando você o interrompe, mas seus dados permanecem seguros no volume n8n_data. Para implantações em produção, consulte a documentação de auto-hospedagem do n8n para conhecer opções de configuração mais avançadas.

Entendendo a interface do n8n

Ao acessar o n8n pela primeira vez, você verá o painel principal: painel do n8n mostrando a lista de fluxos de trabalho com o botão "Criar novo fluxo de trabalho" Principais elementos da interface:
  • Fluxos de trabalho: suas automações salvas aparecem aqui
  • Execuções: histórico das execuções dos fluxos de trabalho
  • Credenciais: chaves de API e tokens de autenticação armazenados
  • Configuração: configuração da conta e do espaço de trabalho
Clique em “Criar novo fluxo de trabalho” para abrir o editor de fluxos de trabalho.

O Canvas do Fluxo de Trabalho

O editor de fluxo de trabalho é onde você criará suas automações: Canvas de fluxo de trabalho vazio do n8n com o botão "+" visível no centro Elementos importantes:
  • Canvas: A área principal onde você posiciona e conecta nós
  • Botão Adicionar Nó (+): Clique nele para adicionar novos nós ao fluxo de trabalho
  • Painel de Nós: Abre ao clicar em ”+” e exibe todos os nós disponíveis
  • Executar Fluxo de Trabalho: Executa manualmente o fluxo de trabalho para testes
  • Salvar: Salva a configuração do fluxo de trabalho
Vamos criar seu primeiro fluxo de trabalho adicionando o nó Firecrawl.

Etapa 3: Instale e configure o nó do Firecrawl

O n8n oferece suporte nativo ao Firecrawl. Instale o nó e conecte-o à sua conta do Firecrawl usando a chave de API criada anteriormente.

Adicione o nó do Firecrawl ao seu fluxo de trabalho

  1. No canvas do seu novo fluxo de trabalho, clique no botão ”+” no centro
  2. O painel de seleção de nós será aberto no lado direito
  3. Na caixa de busca na parte superior, digite “Firecrawl
  4. O nó do Firecrawl aparecerá nos resultados da busca
Clique no botão +, digite "Firecrawl" na busca e veja o nó do Firecrawl aparecer
  1. Clique em “Instalar” ao lado do nó do Firecrawl
  2. Aguarde a conclusão da instalação (isso leva alguns segundos)
  3. Após a instalação, clique no nó do Firecrawl para adicioná-lo ao canvas
Nó do Firecrawl adicionado ao canvas, exibido como uma caixa com o logo do Firecrawl O nó do Firecrawl aparecerá no canvas como uma caixa com o logo do Firecrawl. Esse nó representa uma única operação do Firecrawl no seu fluxo de trabalho.

Conecte sua chave de API do Firecrawl

Usuários do n8n Cloud: A oferta de lançamento, que incluía um plano Hobby gratuito e 100.000 créditos, expirou. Ainda é possível usar o botão OAuth “Conectar ao Firecrawl” com um clique ao adicionar o nó do Firecrawl. Isso cria automaticamente uma nova equipe do Firecrawl vinculada à sua conta do n8n e concede 10.000 créditos gratuitos. Esses créditos não incluem um upgrade para o plano Hobby. Para visualizá-los no painel do Firecrawl, alterne para a equipe vinculada ao n8n usando o seletor de equipes no canto superior esquerdo.
Antes de usar o nó do Firecrawl, você precisa autenticá-lo com sua chave de API:
  1. Clique na caixa do nó do Firecrawl para abrir o painel de configuração à direita
  2. Na parte superior, você verá um menu suspenso “Credencial para conectar”
  3. Como esta é a primeira vez que você faz isso, clique em “Criar nova credencial
Painel de configuração do nó do Firecrawl mostrando o menu suspenso de credenciais com a opção "Criar nova credencial"
  1. Uma janela de configuração da credencial será aberta
  2. Insira um nome para essa credencial (por exemplo, “Minha conta do Firecrawl”)
  3. Cole sua chave de API do Firecrawl no campo “Chave de API”
  4. Clique em “Salvar” na parte inferior
A credencial agora está salva no n8n. Você não precisará inserir sua chave de API novamente nos próximos nós do Firecrawl.

Teste a conexão

Vamos verificar se o nó Firecrawl está conectado corretamente:
  1. Com o nó Firecrawl ainda selecionado, veja o painel de configuração
  2. No menu suspenso “Resource”, selecione “fazer scraping de uma URL e obter seu conteúdo
  3. No campo “URL”, insira: https://firecrawl.dev
  4. Por enquanto, mantenha as outras configurações nos valores padrão
  5. Clique no botão “Test step” no canto inferior direito do nó
Selecionando a operação Scrape, inserindo a URL example.com e clicando no botão Test step Se tudo estiver configurado corretamente, o conteúdo extraído de example.com será exibido no painel de resultado abaixo do nó. Parabéns! Seu nó Firecrawl está conectado e funcionando.

Etapa 4: Crie seu bot do Telegram

Antes de criar seu primeiro fluxo de trabalho, você precisará de um bot do Telegram para receber notificações. Os bots do Telegram são gratuitos e fáceis de criar usando o BotFather do Telegram.

Crie um bot com o BotFather

  1. Abra o Telegram no celular ou computador
  2. Pesquise por “@BotFather” (o bot oficial do Telegram)
  3. Inicie uma conversa com o BotFather clicando em “Iniciar
  4. Envie o comando /newbot para criar um novo bot
  5. O BotFather pedirá que você escolha um nome para o bot (esse é o nome de exibição que os usuários verão)
  6. Insira um nome como “Meu Bot Firecrawl
  7. Em seguida, escolha um nome de usuário para o bot. Ele deve terminar com “bot” (por exemplo, “my_firecrawl_updates_bot”)
  8. Se o nome de usuário estiver disponível, o BotFather criará o bot e enviará uma mensagem com o token do bot
Criando um bot com o BotFather, mostrando todo o fluxo da conversa
Guarde o token do bot em segurança. Esse token funciona como uma senha e permite que o n8n envie mensagens como seu bot. Nunca o compartilhe publicamente.

Encontre seu ID de chat

Para enviar mensagens para si mesmo, você precisa do ID de chat do Telegram:
  1. Abra o navegador e acesse esta URL (substitua YOUR_BOT_TOKEN pelo token do seu bot):
  2. Mantenha esta aba do navegador aberta
  3. No Telegram, pesquise o nome de usuário do bot que você acabou de criar
  4. Inicie uma conversa com o bot clicando em “Iniciar
  5. Envie qualquer mensagem para o bot (por exemplo, “olá”)
  6. Volte à aba do navegador e atualize a página
  7. Procure o campo "chat":{"id": na resposta JSON
  8. O número ao lado de "id": é seu ID de chat (por exemplo, 123456789)
  9. Salve esse ID de chat para usar mais tarde
Navegador mostrando a resposta getUpdates da API do Telegram com o ID de chat destacado
Seu ID de chat é o identificador exclusivo da sua conversa com o bot. Você o usará para informar ao n8n para onde enviar mensagens.
Agora você tem tudo de que precisa para integrar o Telegram aos seus fluxos de trabalho do n8n.

Etapa 5: Crie fluxos de trabalho práticos com o Telegram

Agora, vamos criar três fluxos de trabalho reais que enviam informações diretamente para o Telegram. Estes exemplos demonstram diferentes operações do Firecrawl e como integrá-las às notificações do Telegram.

Exemplo 1: Resumo diário das atualizações do produto Firecrawl

Receba todas as manhãs no Telegram um resumo diário das atualizações do produto Firecrawl. O que você vai criar:
  • Faz scraping do blog de atualizações de produto do Firecrawl diariamente às 9h
  • Usa IA para gerar um resumo do conteúdo
  • Envia o resumo para seu Telegram
Passo a passo:
  1. Crie um novo fluxo de trabalho no n8n
  2. Adicione um nó Schedule Trigger:
    • Clique no botão ”+” no canvas
    • Busque por “Schedule Trigger
    • Configure: todos os dias às 9h
Schedule Trigger configurado para execução diária às 9h
  1. Adicione o nó Firecrawl:
    • Clique em ”+” ao lado de Schedule Trigger
    • Busque e adicione “Firecrawl
    • Selecione sua credencial do Firecrawl
    • Configure:
      • Resource: fazer scraping de uma URL e obter seu conteúdo
      • URL: https://www.firecrawl.dev/blog/category/product-updates
      • Formatos: selecione “Summary”
Adição e configuração do nó Firecrawl com a URL do blog e o formato Summary selecionado
  1. Adicione o nó Telegram:
    • Clique em ”+” ao lado de Firecrawl
    • Busque por “Telegram
    • Clique em “Send a text message” para adicioná-lo ao canvas
  2. Configure as credenciais do Telegram:
    • Clique no nó Telegram para abrir a configuração
    • No menu suspenso “Credential to connect with”, clique em “Create New Credential
    • Cole o token do bot fornecido pelo BotFather
    • Clique em “Save
Configuração de credenciais do Telegram com o campo de token do bot
  1. Configure a mensagem do Telegram:
    • Operation: Send Message
    • Chat ID: insira seu ID de chat
    • Text: por enquanto, deixe uma mensagem “hello”
    • Clique em Execute step para testar o envio de uma mensagem e receber o resumo do Firecrawl.
Configuração do nó Telegram e mapeamento do campo de resumo para o texto da mensagem
  • Agora que você tem a estrutura do resumo do Firecrawl, adicione-o ao texto da mensagem arrastando o campo summary do resultado do nó Firecrawl.
  1. Teste o fluxo de trabalho:
    • Clique em “Execute Workflow
    • Verifique no Telegram se recebeu a mensagem de resumo
Fluxo de trabalho completo mostrando Schedule Trigger → Firecrawl → Telegram com todos os nós conectados
  1. Ative o fluxo de trabalho alternando o interruptor “Active
Agora, seu bot do Telegram enviará todas as manhãs, às 9h, um resumo diário das atualizações do produto Firecrawl.

Exemplo 2: Busca de notícias sobre IA no Telegram

Este fluxo de trabalho usa a operação Search do Firecrawl para encontrar notícias sobre IA e enviar os resultados formatados para o Telegram. Principais diferenças em relação ao Exemplo 1:
  • Usa um Manual Trigger em vez de Schedule (execução sob demanda)
  • Usa a operação Search em vez de Scrape
  • Inclui um nó Code para formatar vários resultados
Crie o fluxo de trabalho:
  1. Crie um novo fluxo de trabalho e adicione um nó Manual Trigger
  2. Adicione um nó Firecrawl com estas configurações:
    • Resource: pesquisar e, opcionalmente, fazer scraping dos resultados de busca
    • Query: ai news
    • Limit: 5
Configuração do nó Firecrawl Search com a consulta "ai news"
  1. Adicione um nó Code para formatar os resultados de busca:
    • Selecione “Run Once for All Items”
    • Cole este código:
Adicionando o nó Code e colando o script de formatação
  1. Atualize o nó Telegram (usando a credencial salva):
    • Text: Arraste o campo message do nó Code
Execução completa do fluxo de trabalho com notícias de IA enviadas ao Telegram
Substitua o Manual Trigger por um Schedule Trigger para receber atualizações automáticas de notícias de IA em intervalos definidos.

Exemplo 3: Resumo de Notícias com IA

Este fluxo de trabalho adiciona IA ao Exemplo 2, usando a OpenAI para gerar resumos inteligentes das notícias mais recentes sobre IA antes de enviá-las ao Telegram. Principais mudanças em relação ao Exemplo 2:
  • Adicione a configuração das credenciais da OpenAI
  • Adicione o nó AI Agent entre Code e Telegram
  • O AI Agent analisa e resume todas as notícias de forma inteligente
  • O Telegram recebe o resumo gerado por IA em vez da lista bruta de notícias
Modifique o fluxo de trabalho:
  1. Obtenha sua chave de API da OpenAI:
    • Acesse platform.openai.com/api-keys
    • Faça login ou crie uma conta
    • Clique em “Create new secret key
    • Dê um nome a ela (por exemplo, “n8n Integration”)
    • Copie a chave de API imediatamente (você não poderá vê-la novamente)
Painel da OpenAI mostrando a criação de uma chave de API
  1. Adicione e conecte o nó AI Agent:
    • Clique em ”+” após o nó Code
    • Pesquise por “Basic LLM Chain” ou “AI Agent
    • Arraste o campo message do nó Code para o campo de prompt de entrada do AI Agent
    • Selecione OpenAI como provedor de LLM
Adicionando o nó AI Agent, arrastando a entrada do nó Code e conectando a OpenAI como LLM
  1. Adicione suas credenciais da OpenAI:
    • Clique em “Create New Credential” para a OpenAI
    • Cole sua chave de API da OpenAI
    • Selecione o modelo: gpt-5-mini (mais econômico) ou gpt-5 (mais avançado)
    • Clique em “Save
Adicionando credenciais da OpenAI ao nó AI Agent
  1. Adicione o prompt de sistema ao AI Agent:
    • No nó AI Agent, adicione este prompt de sistema:
Adicionando o prompt do sistema ao nó AI Agent
  1. Atualize o nó Telegram e teste:
    • Atualize o nó Telegram:
      • Texto: Arraste o resultado do AI Agent (o resumo gerado)
      • Remova o mapeamento antigo da mensagem do nó Code
    • Clique em “Executar fluxo de trabalho” para testar
    • A IA analisará todos os artigos de notícias e criará um resumo
    • Verifique o Telegram para conferir o resumo gerado pela IA
Execução completa do fluxo de trabalho com o resumo gerado pela IA enviado ao Telegram
O AI Agent recebe todos os artigos de notícias formatados e cria um resumo inteligente, facilitando a compreensão rápida de tendências e desenvolvimentos importantes.

Entendendo as operações do Firecrawl

Agora que você criou alguns fluxos de trabalho, vamos explorar as diferentes operações do Firecrawl disponíveis no n8n. Cada operação foi desenvolvida para casos de uso específicos de scraping web.

Fazer scraping de uma URL e obter seu conteúdo

Extrai o conteúdo de uma única página da web e o retorna em diversos formatos. O que faz:
  • Faz scraping de uma única URL
  • Retorna Markdown limpo, HTML ou resumos gerados por IA
  • Pode fazer capturas de tela e extrair links
Ideal para:
  • Extração de artigos
  • Monitoramento de páginas de produtos
  • Scraping de posts de blog
  • Geração de resumos de páginas
Exemplo de caso de uso: Resumos diários de blogs (como no Exemplo 1 acima)

Scrape + Interact com perfis persistentes

Em fluxos de trabalho que usam Scrape seguido de Interact, defina o profile persistente na etapa Scrape. A etapa Interact precisa apenas do scrapeId da resposta de scraping, além de um prompt ou código. Não adicione profile ao corpo da solicitação do Interact; o Interact herda o perfil do job de scraping. Para salvar cookies, localStorage e outros estados do navegador, encerre a sessão de interação quando o fluxo de trabalho terminar. Se você precisar apenas ler um perfil existente em uma execução posterior do fluxo de trabalho, defina saveChanges como false na etapa Scrape. Se a versão instalada do nó Firecrawl n8n não expõe configurações de perfil na operação Scrape, atualize para a versão mais recente do nó Firecrawl n8n. Se sua versão do n8n oferecer suporte a opções personalizadas de solicitação ou corpo para o nó, você poderá passar o mesmo objeto profile nelas:

Pesquisar e, opcionalmente, fazer scraping dos resultados de busca

Realiza buscas na web e retorna resultados com scraping de conteúdo opcional. O que faz:
  • Pesquisa na web, em notícias ou imagens
  • Retorna títulos, descrições e URLs
  • Opcionalmente, faz scraping do conteúdo completo dos resultados
Ideal para:
  • Automação de pesquisa
  • Monitoramento de notícias
  • Descoberta de tendências
  • Encontrar conteúdo relevante
Exemplo de caso de uso: agregação de notícias sobre IA (como no Exemplo 2 acima)

Rastrear um site

Descobre e faz scraping de várias páginas de um site de forma recursiva. O que faz:
  • Segue links automaticamente
  • Faz scraping de várias páginas em uma única operação
  • Pode filtrar URLs por padrões
Ideal para:
  • Extração completa de documentação
  • Arquivamento de sites
  • Coleta de dados de várias páginas

Mapeie um site e obtenha URLs

Retorna todas as URLs encontradas em um site sem fazer scraping do conteúdo. O que faz:
  • Descobre todos os links de um site
  • Retorna uma lista limpa de URLs
  • Rápido e leve
Ideal para:
  • Descoberta de URLs
  • Geração de sitemap
  • Planejamento de rastreamentos maiores

Extrair Dados

Usa IA para extrair informações estruturadas com base em prompts ou schemas personalizados. O que faz:
  • Extração de dados com IA
  • Retorna dados no formato especificado
  • Funciona em várias páginas
Ideal para:
  • Extração de dados personalizada
  • Criação de bancos de dados
  • Coleta de informações estruturadas

Extração em lote

Faz scraping de várias URLs em paralelo de forma eficiente. O que faz:
  • Processa várias URLs de uma só vez
  • É mais eficiente do que usar loops
  • Retorna todos os resultados de uma vez
Ideal para:
  • Processar listas de URLs
  • Coleta de dados em massa
  • Projetos de scraping em grande escala

Agente

Usa um agente de IA para navegar e extrair dados de sites de forma autônoma com base em um prompt em linguagem natural. O que faz:
  • Aceita um prompt que descreve os dados necessários
  • O agente de IA navega e extrai informações de forma autônoma
  • Disponível nos modos Sync (aguarda os resultados) e Async (retorna um ID do job imediatamente)
  • Use Get Agent Status para consultar os resultados ao usar o modo Async
Ideal para:
  • Coleta complexa de dados em várias páginas, orientada por um prompt
  • Extração de informações quando você não conhece a estrutura exata da página
  • Tarefas de pesquisa que exigem navegar por várias páginas
Sync vs. Async:
  • Agent (Sync) inicia o job e aguarda o resultado em uma única etapa — a opção mais simples para a maioria dos casos de uso. O parâmetro Max Wait Time controla por quanto tempo o nó consulta o status antes de atingir o tempo limite (padrão: 300 segundos; máximo: 600 segundos). Se o job do agente demorar mais do que isso, o nó retornará um status de tempo limite, embora o job ainda possa ser concluído no Firecrawl. Para jobs que podem ultrapassar 10 minutos, use o modo Async.
  • Agent (Async) retorna um ID do job imediatamente. Adicione um segundo nó do Firecrawl com a operação Get Agent Status para recuperar os resultados quando o job for concluído.
Para mais detalhes sobre o recurso Agent, consulte a documentação do Agent.

Browser Sandbox

Fornece uma sessão persistente do navegador que você pode controlar com código, permitindo automatizar o navegador em várias etapas dentro de uma única sessão. Operações:
  • Criar sessão do navegador — inicia uma nova sessão do navegador e retorna um sessionId
  • Executar código no navegador — executa código JavaScript, Python ou bash na sessão (usando o sessionId da etapa Criar)
  • Listar sessões do navegador — lista sessões ativas ou encerradas
  • Excluir sessão do navegador — encerra uma sessão quando você terminar
Ideal para:
  • Fluxos de trabalho de navegador em várias etapas que exigem manter o estado entre páginas
  • Navegação dinâmica em páginas, quando o número de etapas não é conhecido antecipadamente
  • Fluxos de trabalho que usam perfis persistentes do navegador para preservar cookies e localStorage entre execuções
No n8n, selecione o recurso Browser no nó Firecrawl para acessar essas operações. Passe o sessionId da etapa Criar para cada etapa subsequente de Executar ou Excluir. Use o nó Loop Over Items do n8n para iterar por uma lista dinâmica de páginas, chamando Executar para cada uma na mesma sessão. Para mais detalhes sobre o Browser Sandbox, consulte a documentação do Browser Sandbox.

Modelos e exemplos de fluxos de trabalho

Em vez de começar do zero, você pode usar modelos prontos. A comunidade do n8n criou diversos fluxos de trabalho do Firecrawl que você pode copiar e personalizar.

Tutorial completo do n8n

Crie um chatbot de IA com acesso à web usando Firecrawl e n8n

8 fluxos de trabalho para produção

Modelos prontos para uso para geração de leads, monitoramento de preços e muito mais

Pipeline de RAG com Supabase pgvector

Faça scraping de páginas, gere embeddings e armazene-os no Supabase pgvector para RAG

Enriquecimento de leads com IA

Faça scraping de sites de empresas e extraia dados comerciais estruturados

Pipeline de RAG com Pinecone

Faça scraping de páginas, gere embeddings e armazene-os no Pinecone para RAG

Fluxos de trabalho da comunidade n8n

Explore centenas de fluxos de trabalho que usam Firecrawl

Integração oficial do n8n

Consulte a documentação da integração oficial

Como importar modelos

Para usar um modelo da comunidade do n8n:
  1. Clique em um link de modelo de fluxo de trabalho
  2. Na página do modelo, clique no botão “Importar modelo para a instância auto-hospedada em localhost:5678
  3. O fluxo de trabalho será aberto na sua instância do n8n
  4. Configure as credenciais de cada nó
  5. Personalize as configurações para seu caso de uso
  6. Ative o fluxo de trabalho
Importação de um modelo do n8n.io, mostrando o botão de importação e o fluxo de trabalho aberto no n8n

Boas práticas

Siga estas diretrizes para criar fluxos de trabalho confiáveis e eficientes:

Testes e depuração

  • Sempre teste os fluxos de trabalho manualmente antes de ativar os agendamentos
  • Use o botão “Execute Workflow” para testar todo o fluxo
  • Verifique os dados de resultado em cada nó para confirmar se estão corretos
  • Use a aba “Executions” para revisar execuções anteriores e depurar problemas
Aba Executions mostrando o histórico de execuções do fluxo de trabalho com data, hora e status

Tratamento de erros

  • Adicione nós Error Trigger para capturar e tratar falhas
  • Configure notificações para quando os fluxos de trabalho falharem
  • Use a configuração “Continue On Fail” em nós não críticos
  • Monitore regularmente a execução dos seus fluxos de trabalho

Otimização de desempenho

  • Use extração em lote para várias URLs em vez de loops
  • Defina limites de taxa adequados para evitar sobrecarregar os sites de destino
  • Armazene dados em cache quando possível para reduzir solicitações desnecessárias
  • Agende fluxos de trabalho intensivos para horários de menor movimento

Segurança

  • Nunca exponha chaves de API nas configurações de fluxos de trabalho
  • Use o sistema de credenciais do n8n para armazenar a autenticação com segurança
  • Tenha cuidado ao compartilhar fluxos de trabalho publicamente
  • Respeite os termos de serviço e o robots.txt dos sites-alvo

Próximas etapas

Agora você tem os fundamentos para criar automações de web scraping com o Firecrawl e o n8n. Veja como continuar aprendendo:

Explore recursos avançados

  • Estude configurações de webhooks para processamento de dados em tempo real
  • Experimente a extração com IA usando prompts e schemas
  • Crie fluxos de trabalho complexos de várias etapas com lógica de ramificação

Participe da comunidade

  • Discord do Firecrawl - Obtenha ajuda com o Firecrawl e converse sobre scraping web
  • Fórum da Comunidade n8n - Faça perguntas sobre automação de fluxos de trabalho
  • Compartilhe seus fluxos de trabalho e aprenda com outras pessoas
  1. Conclua os fluxos de trabalho de exemplo deste guia
  2. Modifique modelos da biblioteca da comunidade
  3. Crie um fluxo de trabalho para resolver um problema real no seu trabalho
  4. Explore operações avançadas do Firecrawl
  5. Contribua com seus próprios modelos para ajudar outras pessoas
Precisa de ajuda? Se você estiver com dificuldades ou tiver dúvidas, as comunidades do Firecrawl e do n8n são ativas e prestativas. Não hesite em pedir orientação enquanto cria suas automações.

Recursos adicionais