Introducción a Firecrawl y n8n

¿Por qué usar Firecrawl con n8n?
- Extraen datos de cualquier sitio web de forma fiable
- Conectan los datos extraídos con otras herramientas empresariales
- Se ejecutan según una programación o se activan mediante eventos
- Escalan desde tareas simples hasta pipelines complejos
Paso 1: Crea tu cuenta de Firecrawl
Regístrate en Firecrawl
- Ve a firecrawl.dev en tu navegador web
- Haz clic en el botón “Empezar” o “Registrarse”
- Crea una cuenta con tu dirección de correo electrónico o inicia sesión con GitHub
- Verifica tu correo electrónico si se te solicita
Obtén tu clave de API
- Ve al dashboard de Firecrawl
- Accede a la página de claves de API
- Haz clic en “Create New clave de API”
- Asigna a tu clave un nombre descriptivo (p. ej., “n8n Integration”)
- Copia la clave de API generada y guárdala en un lugar seguro

Tu clave de API es como una contraseña. Guárdala de forma segura y nunca la compartas públicamente. La necesitarás en la siguiente sección.
Paso 2: Configura n8n
Selecciona tu versión de n8n
- No requiere instalación
- Plan Free disponible
- Infraestructura gestionada
- Actualizaciones automáticas
- Control total sobre los datos
- Se ejecuta en tus propios servidores
- Requiere instalar Docker
- Ideal para usuarios avanzados con requisitos de seguridad específicos
Opción A: n8n Cloud (recomendado para principiantes)
- Visita n8n.cloud
- Haz clic en “Start Free” o “Sign Up”
- Regístrate con tu dirección de correo electrónico o GitHub
- Completa el proceso de verificación
- Accederás a tu dashboard de n8n

Opción B: Autogestionado con Docker
- Docker Desktop instalado en tu equipo
- Conocimientos básicos de la línea de comandos o la terminal
- Abre la terminal o el símbolo del sistema
- Crea un volumen de Docker para conservar los datos de tu flujo de trabajo:
- Ejecuta el contenedor de Docker de n8n:

- Espera a que n8n se inicie. Verás una salida que indica que el servidor está en funcionamiento.
- Abre el navegador web y ve a
http://localhost:5678 - Crea tu cuenta de n8n registrándote con una dirección de correo electrónico

La opción
--rm elimina automáticamente el contenedor cuando lo detienes, pero tus datos permanecen seguros en el volumen n8n_data. Para implementaciones en producción, consulta la documentación de autoalojamiento de n8n para conocer opciones de configuración más avanzadas.Conocer la interfaz de n8n

- Flujos de trabajo: Aquí aparecen tus automatizaciones guardadas
- Ejecuciones: Historial de ejecuciones de los flujos de trabajo
- Credenciales: Claves de API y tokens de autenticación almacenados
- Configuración: Configuración de la cuenta y el espacio de trabajo
El lienzo del flujo de trabajo

- Lienzo: El área principal donde colocas y conectas nodos
- Botón Añadir nodo (+): Haz clic para añadir nuevos nodos a tu flujo de trabajo
- Panel de nodos: Se abre al hacer clic en ”+” y muestra todos los nodos disponibles
- Ejecutar flujo de trabajo: Ejecuta manualmente tu flujo de trabajo para probarlo
- Guardar: Guarda la configuración de tu flujo de trabajo
Paso 3: Instala y configura el nodo de Firecrawl
Añade el nodo de Firecrawl a tu flujo de trabajo
- En el lienzo de tu nuevo flujo de trabajo, haz clic en el botón ”+” del centro
- Se abrirá el panel de selección de nodos en el lado derecho
- En el cuadro de búsqueda de la parte superior, escribe “Firecrawl”
- Verás que el nodo de Firecrawl aparece en los resultados de búsqueda

- Haz clic en “Instalar” junto al nodo de Firecrawl
- Espera a que finalice la instalación (tardará unos segundos)
- Una vez instalado, haz clic en el nodo de Firecrawl para añadirlo al lienzo

Conecta tu clave de API de Firecrawl
- Haz clic en el recuadro del nodo de Firecrawl para abrir su panel de configuración a la derecha.
- En la parte superior, verás un menú desplegable llamado “credencial para conectarse”.
- Como es la primera vez que lo haces, haz clic en “crear nueva credencial”.

- Se abrirá una ventana de configuración de credenciales.
- Introduce un nombre para esta credencial (por ejemplo, “Mi cuenta de Firecrawl”).
- Pega tu clave de API de Firecrawl en el campo “clave de API”.
- Haz clic en “Save” en la parte inferior.
Prueba la conexión
- Con el nodo de Firecrawl todavía seleccionado, revisa el panel de configuración.
- En el menú desplegable “Recurso”, selecciona “Hacer scraping de una URL y obtener su contenido”.
- En el campo “URL”, introduce:
https://firecrawl.dev. - Por ahora, deja el resto de la configuración con los valores predeterminados.
- Haz clic en el botón “Probar paso” en la esquina inferior derecha del nodo.

Paso 4: Crea tu bot de Telegram
Crea un bot con BotFather
- Abre Telegram en tu teléfono o computadora
- Busca “@BotFather” (el bot oficial de Telegram)
- Inicia una conversación con BotFather haciendo clic en “Start”
- Envía el comando
/newbotpara crear un nuevo bot - BotFather te pedirá que elijas un nombre para tu bot (este es el nombre que verán los usuarios)
- Introduce un nombre como “My Firecrawl Bot”
- A continuación, elige un nombre de usuario para tu bot. Debe terminar en “bot” (p. ej., “my_firecrawl_updates_bot”)
- Si el nombre de usuario está disponible, BotFather creará tu bot y te enviará un mensaje con el token de tu bot

Guarda el token de tu bot de forma segura. Es como una contraseña que permite a n8n enviar mensajes como tu bot. Nunca lo compartas públicamente.
Obtén tu ID de chat
- Abre el navegador web y visita esta URL (sustituye
YOUR_BOT_TOKENpor el token de tu bot): - Mantén abierta esta pestaña del navegador
- Busca el nombre de usuario de tu bot en Telegram (el que acabas de crear)
- Inicia una conversación con tu bot haciendo clic en “Iniciar”
- Envía cualquier mensaje a tu bot (por ejemplo, “hola”)
- Vuelve a la pestaña del navegador y actualiza la página
- Busca el campo
"chat":{"id":en la respuesta JSON - El número junto a
"id":es tu ID de chat (por ejemplo,123456789) - Guarda este ID de chat para usarlo más adelante

Tu ID de chat es el identificador único de tu conversación con el bot. Lo usarás para indicar a n8n dónde enviar los mensajes.
Paso 5: Crea flujos de trabajo prácticos con Telegram
Ejemplo 1: Resumen diario de actualizaciones de producto de Firecrawl
- Hace scraping del blog de actualizaciones de producto de Firecrawl todos los días a las 9:00
- Usa IA para generar un resumen del contenido
- Envía el resumen a Telegram
- Crea un nuevo flujo de trabajo en n8n
- Añade un nodo Schedule Trigger:
- Haz clic en el botón ”+” del lienzo
- Busca “Schedule Trigger”
- Configúralo para que se ejecute todos los días a las 9:00

- Añade el nodo Firecrawl:
- Haz clic en ”+” junto a Schedule Trigger
- Busca y añade “Firecrawl”
- Selecciona tu credencial de Firecrawl
- Configura:
- Recurso: Hacer scraping de una URL y obtener su contenido
- URL:
https://www.firecrawl.dev/blog/category/product-updates - Formatos: Selecciona “Resumen”

-
Añade el nodo Telegram:
- Haz clic en ”+” junto a Firecrawl
- Busca “Telegram”
- Haz clic en “Send a text message” para añadirlo al lienzo
-
Configura las credenciales de Telegram:
- Haz clic en el nodo Telegram para abrir su configuración
- En el menú desplegable “Credencial para conectarse”, haz clic en “Crear nueva credencial”
- Pega el token de tu bot de BotFather
- Haz clic en “Guardar”
- Configura el mensaje de Telegram:
- Operación: Enviar mensaje
- ID de chat: Introduce tu ID de chat
- Texto: Por ahora, deja el mensaje “hello”
- Haz clic en Ejecutar paso para probar el envío de un mensaje y recibir el resumen de Firecrawl.
- Ahora que tienes la estructura del resumen de Firecrawl, añade el resumen al texto del mensaje arrastrando el campo
summarydesde la salida del nodo Firecrawl.
- Prueba el flujo de trabajo:
- Haz clic en “ejecutar flujo de trabajo”
- Revisa Telegram para ver el mensaje con el resumen

- Activa el flujo de trabajo con el interruptor “Active”
Ejemplo 2: Búsqueda de noticias de IA en Telegram
- Usa un Manual Trigger en lugar de Schedule (se ejecuta bajo demanda)
- Usa la operación Search en lugar de scraping
- Incluye un nodo Code para formatear varios resultados
- Crea un nuevo flujo de trabajo y añade un nodo Manual Trigger
-
Añade un nodo Firecrawl con esta configuración:
- recurso: Buscar y, opcionalmente, hacer scraping de los resultados de búsqueda
- Query:
ai news - Limit: 5

- Añade un nodo Code para formatear los resultados de búsqueda:
- Selecciona “Ejecutar una vez para todos los elementos”
- Pega este código:

- Actualiza el nodo Telegram (con tu credencial guardada):
- Texto: Arrastra el campo
messagedesde el nodo Code
- Texto: Arrastra el campo
Ejemplo 3: Resumen de noticias con IA
- Configurar las credenciales de OpenAI
- Añadir el nodo agente de IA entre Code y Telegram
- agente de IA analiza y resume de forma inteligente todos los artículos de noticias
- Telegram recibe el resumen generado por IA en lugar de la lista de noticias sin procesar
- Obtén tu clave de API de OpenAI:
- Ve a platform.openai.com/api-keys
- Inicia sesión o crea una cuenta
- Haz clic en “Create new secret key”
- Asígnale un nombre (p. ej., “n8n Integration”)
- Copia la clave de API inmediatamente (no podrás volver a verla)

- Añade y conecta el nodo agente de IA:
- Haz clic en ”+” después del nodo Code
- Busca “Basic LLM Chain” o “agente de IA”
- Arrastra el campo
messagedel nodo Code al campo del prompt de entrada de agente de IA - Selecciona OpenAI como proveedor de LLM
- Añade tus credenciales de OpenAI:
- Haz clic en “crear nueva credencial” para OpenAI
- Pega tu clave de API de OpenAI
- Selecciona el modelo: gpt-5-mini (económico) o gpt-5 (más capaz)
- Haz clic en “Save”

- Añade el System prompt a agente de IA:
- En el nodo agente de IA, añade este System prompt:

- Actualiza el nodo de Telegram y pruébalo:
- Actualiza el nodo de Telegram:
- Texto: Arrastra la salida del agente de IA (el resumen generado)
- Elimina el mapeo anterior al mensaje del nodo Code
- Haz clic en “ejecutar flujo de trabajo” para probarlo
- La IA analizará todos los artículos de noticias y creará un resumen
- Revisa Telegram para ver el resumen generado por la IA
- Actualiza el nodo de Telegram:
El agente de IA recibe todos los artículos de noticias con formato y crea un resumen inteligente, lo que facilita identificar de un vistazo las tendencias y los avances importantes.
Operaciones de Firecrawl
Haz scraping de una URL y obtén su contenido
- Hace scraping de una sola URL
- Devuelve markdown limpio, HTML o resúmenes generados por IA
- Puede capturar capturas de pantalla y extraer enlaces
- Extracción de artículos
- Monitoreo de páginas de productos
- Scraping de publicaciones de blog
- Generación de resúmenes de páginas
scraping + Interact con perfiles persistentes
profile persistente en el paso scraping. El paso Interact solo necesita el scrapeId de la respuesta de scraping, además de un prompt o código. No añada profile al cuerpo de la solicitud de Interact; Interact hereda el perfil del trabajo de scraping.
Para guardar cookies, localStorage y otros datos de estado del navegador, detenga la sesión de interacción cuando finalice el flujo de trabajo. Si solo necesita leer un perfil existente en una ejecución posterior del flujo de trabajo, establezca saveChanges en false en el paso scraping.
Si la versión instalada del nodo Firecrawl para n8n no muestra la configuración de perfiles en la operación scraping, actualícela a la versión más reciente. Si su versión de n8n admite opciones personalizadas de solicitud o cuerpo para el nodo, también puede pasar allí el mismo objeto profile:
Buscar y, opcionalmente, hacer scraping de los resultados de búsqueda
- Busca en la web, noticias o
images - Devuelve títulos, descripciones y URL
- Opcionalmente, hace scraping del contenido completo de los resultados
- Automatización de la investigación
- Supervisión de noticias
- Detección de tendencias
- Encontrar contenido relevante
Rastrear un sitio web
- Sigue enlaces automáticamente
- Scrapea varias páginas en una sola operación
- Puede filtrar URL por patrones
- Extracción completa de documentación
- Archivado de sitios
- Recopilación de datos de varias páginas
Mapea un sitio web y obtén URL
- Descubre todos los enlaces de un sitio
- Devuelve una lista limpia de URL
- Rápido y ligero
- Descubrimiento de URL
- Generación de mapas de sitio
- Planificación de crawls más grandes
Extraer datos
- Extracción de datos con IA
- Devuelve los datos en el formato especificado
- Funciona en varias páginas
- Extracción de datos personalizada
- Crear bases de datos
- Recopilación de información estructurada
Extracción por lotes
- Procesa varias URL a la vez
- Es más eficiente que usar bucles
- Devuelve todos los resultados juntos
- Procesar listas de URL
- Recopilar datos de forma masiva
- Proyectos de scraping a gran escala
Agente
- Acepta una indicación que describe los datos que necesitas
- El agente de IA navega y extrae información de forma autónoma
- Está disponible en modo Sync (espera los resultados) y modo Async (devuelve un ID de trabajo de inmediato)
- Usa Get Agent Status para consultar los resultados al utilizar el modo Async
- Recopilar datos complejos de varias páginas a partir de una indicación
- Extraer información cuando no conoces la estructura exacta de la página
- Tareas de investigación que requieren navegar por varias páginas
- Agent (Sync) inicia el trabajo y espera el resultado en un solo paso; es la opción más simple para la mayoría de los casos de uso. El parámetro Max Wait Time controla durante cuánto tiempo el nodo consulta el estado antes de que se agote el tiempo de espera (predeterminado: 300 segundos; máximo: 600 segundos). Si el trabajo del agente tarda más, el nodo devuelve un estado de tiempo de espera agotado, aunque el trabajo aún pueda completarse en Firecrawl. Para trabajos que puedan superar los 10 minutos, usa el modo Async.
- Agent (Async) devuelve un ID de trabajo de inmediato. Añade un segundo nodo de Firecrawl con la operación Get Agent Status para recuperar los resultados una vez que se complete el trabajo.
Sandbox del navegador
- Crear sesión del navegador — inicia una nueva sesión del navegador y devuelve un
sessionId - Ejecutar código del navegador — ejecuta código JavaScript, Python o bash en la sesión (mediante el
sessionIddel paso de creación) - Listar sesiones del navegador — muestra las sesiones activas o eliminadas
- Eliminar sesión del navegador — finaliza una sesión cuando termines
- Flujos de trabajo del navegador de varios pasos que requieren mantener el estado entre páginas
- Navegación dinámica entre páginas cuando el número de pasos se desconoce de antemano
- Flujos de trabajo que usan perfiles persistentes del navegador para conservar las cookies y el localStorage entre ejecuciones
sessionId del paso de creación a cada paso posterior de ejecución o eliminación. Usa el nodo Loop Over Items de n8n para iterar sobre una lista dinámica de páginas y ejecutar código para cada una dentro de la misma sesión.
Para obtener más información sobre la función Sandbox del navegador, consulta la documentación del Sandbox del navegador.
Plantillas y ejemplos de flujos de trabajo
Plantillas destacadas
Tutorial completo de n8n
Crea un chatbot de IA con acceso a la web utilizando Firecrawl y n8n
8 flujos de trabajo en producción
Plantillas listas para usar para generar leads, supervisar precios y más
Pipeline RAG de Supabase pgvector
Haz scraping de páginas para generar embeddings y almacenarlos en Supabase pgvector para RAG
Enriquecimiento de leads con IA
Haz scraping de sitios web de empresas y extrae señales empresariales estructuradas
Pipeline RAG de Pinecone
Haz scraping de páginas para generar embeddings y almacenarlos en Pinecone para RAG
Flujos de trabajo de la comunidad de n8n
Explora cientos de flujos de trabajo que utilizan Firecrawl
Integración oficial de n8n
Consulta la documentación de la integración oficial
Cómo importar plantillas
- Haz clic en el enlace de una plantilla de flujo de trabajo.
- En la página de la plantilla, haz clic en el botón “Importar plantilla a la instancia autogestionada localhost:5678”.
- El flujo de trabajo se abrirá en tu instancia de n8n.
- Configura las credenciales de cada nodo.
- Personaliza la configuración según tu caso de uso.
- Activa el flujo de trabajo.

Prácticas recomendadas
Pruebas y depuración
- Prueba siempre los flujos de trabajo manualmente antes de activar las programaciones
- Usa el botón “ejecutar flujo de trabajo” para probar todo el flujo
- Comprueba los datos de salida en cada nodo para verificar que sean correctos
- Usa la pestaña “Executions” para revisar ejecuciones anteriores y depurar problemas

Manejo de errores
- Añade nodos Error Trigger para detectar y gestionar fallos
- Configura notificaciones cuando fallen los flujos de trabajo
- Usa la configuración “Continue On Fail” en nodos no críticos
- Supervisa periódicamente las ejecuciones de tus flujos de trabajo
Optimización del rendimiento
- Usa extracción por lotes para varias URL en lugar de bucles
- Establece límites de tasa adecuados para evitar sobrecargar los sitios de destino
- Almacena los datos en caché cuando sea posible para reducir solicitudes innecesarias
- Programa flujos de trabajo intensivos durante las horas de menor actividad
Seguridad
- Nunca expongas las claves de API en las configuraciones de los flujos de trabajo
- Usa el sistema de credenciales de n8n para almacenar de forma segura la información de autenticación
- Ten cuidado al compartir flujos de trabajo públicamente
- Respeta los términos de servicio y el archivo robots.txt de los sitios web objetivo
Próximos pasos
Explora funciones avanzadas
- Consulta las configuraciones de webhook para procesar datos en tiempo real
- Experimenta con la extracción basada en IA mediante prompts y schemas
- Crea flujos de trabajo complejos de varios pasos con lógica condicional
Únete a la comunidad
- Firecrawl Discord - Obtén ayuda con Firecrawl y conversa sobre web scraping
- Foro de la comunidad de n8n - Haz preguntas sobre automatización de flujos de trabajo
- Comparte tus flujos de trabajo y aprende de los demás
Ruta de aprendizaje recomendada
- Completa los flujos de trabajo de ejemplo de esta guía
- Modifica las plantillas de la biblioteca de la comunidad
- Crea un flujo de trabajo para resolver un problema real en tu trabajo
- Explora las operaciones avanzadas de Firecrawl
- Comparte tus propias plantillas para ayudar a otras personas
¿Necesitas ayuda? Si te atascas o tienes dudas, las comunidades de Firecrawl y n8n son activas y están dispuestas a ayudar. No dudes en pedir orientación mientras creas tus automatizaciones.

