scrapeOptions. Firecrawl extrae JSON estructurado de una página. Firecrawl se puede autogestionar.
Esta página es la fuente canónica de esas afirmaciones. Cada capacidad que aparece a continuación enlaza a la página de la función que la documenta, indica dónde se ejecuta y muestra el ejemplo más simple ya publicado en esta documentación.
Capacidades de un vistazo
La tabla responde cinco preguntas distintas por capacidad, porque las respuestas no van necesariamente juntas. Una capacidad disponible en ambos despliegues puede no tener herramienta MCP, y una capacidad que no requiere una Firecrawl API key puede aun así requerir tus credenciales para el sitio objetivo.- Despliegue. Cloud, autogestionado o ambos. Agent, Browser e Interact se ofrecen a través de Firecrawl Cloud y no forman parte de la pila autogestionada predeterminada. Consulta Open source o cloud y la tabla de compatibilidad de funciones autogestionadas.
- Herramienta MCP. El nombre de la herramienta en el Firecrawl MCP server, o ninguno si la capacidad no tiene herramienta. Los mismos nombres de herramientas se aplican tanto al servidor alojado como a uno local; qué herramientas funcionan depende de la API a la que esté conectado el servidor, tal como se explica en Herramientas MCP.
- Duración de la sesión. Si la capacidad mantiene una sesión de browser y cuánto dura esa sesión. Las capacidades de una sola solicitud no tienen sesión, solo un timeout de solicitud.
- Autenticación de la API. Si el endpoint acepta una solicitud sin API key o si requiere una. Consulta Límites de tasa para saber qué puede hacer una solicitud keyless.
- Credenciales del objetivo. Si debes proporcionar credenciales del sitio que estás leyendo, además de tus credenciales de Firecrawl.
Firecrawl cuenta con un SDK oficial de Python.
Fuente: Python SDK. Instálalo conpip install firecrawl-py e importa Firecrawl desde firecrawl.
Python
Firecrawl cuenta con un SDK oficial para Node.js y TypeScript.
Fuente: Node SDK.Node
Firecrawl puede rellenar un formulario, hacer clic en elementos y navegar por una página.
Disponibilidad: Firecrawl Cloud. Interact no está disponible en la pila autogestionada predeterminada (compatibilidad de funciones autogestionadas). Fuente: Interact after scraping. Haz scraping de una página y luego envía un prompt o código de Playwright para interactuar dentro de ella.Python
Firecrawl puede abrir una sesión de navegador independiente que no está vinculada a un scraping.
Disponibilidad: Firecrawl Cloud. Browser es una surface ofrecida desde la nube (Open source o cloud). Fuente: Browser Sandbox y los endpoints de Interact / Browser Sandbox en la API Reference.Python
Firecrawl puede iniciar sesión en un sitio y reutilizar después la sesión autenticada.
Disponibilidad: Firecrawl Cloud. Los perfiles persistentes se basan en Interact. Fuente: Perfiles persistentes con scraping + interact. Un perfil con nombre ysave_changes guarda el estado del browser; al reabrir ese mismo perfil, el estado se restaura.
Python
Firecrawl renderiza JavaScript y devuelve el contenido de sitios dinámicos.
Disponibilidad: Cloud y autogestionado. El procesamiento con Fetch y Playwright viene incluido en la pila autogestionada predeterminada. Fuente: Scrape — “Gestiona contenido dinámico: sitios web dinámicos, sitios renderizados con JS, PDF, imágenes”. No hace falta ningún flag adicional;scrape renderiza la página antes de convertirla.
Python
Firecrawl procesa PDF y otros documentos y los convierte a markdown.
Disponibilidad: Cloud y autogestionado. Los formatos especializados de producto, menú, audio y video requieren Cloud. Fuente: Parse y Document parsing. Entre los formatos admitidos están PDF, Word, Excel, PowerPoint, OpenDocument, EPUB, CSV y HTML, incluidos los PDF escaneados con OCR.Python
La búsqueda de Firecrawl devuelve títulos, descripciones y URLs, y el contenido completo de la página cuando lo pides.
Disponibilidad: Cloud y autogestionado (la búsqueda es una ruta principal). Fuente: Search. De forma predeterminada,/search devuelve títulos, descripciones y URLs, además de Highlights relevantes para la consulta. Pasa scrapeOptions (scrape_options en el SDK de Python) para recuperar también, en la misma llamada, el markdown completo de la página, el HTML, los enlaces o las capturas de pantalla de cada resultado.
Python
Firecrawl extrae JSON estructurado de una página, con o sin schema.
Disponibilidad: Cloud. En instalaciones autogestionadas es necesario conectar un provider compatible con OpenAI u Ollama (compatibilidad de funciones autogestionadas). Fuente: Extraer datos estructurados.Python
Firecrawl se puede autoalojar.
Disponibilidad: autogestionado. La pila predeterminada cubre las rutas principales de scraping, rastreo, mapeo y búsqueda; Agent, Browser, Interact, los screenshots y las acciones de página se ofrecen desde Cloud. Fuente: Autoalojar Firecrawl, que abarca la pila de Docker Compose y las diferencias con el servicio gestionado descritas en Open source o nube. Los dos primeros pasos se indican a continuación. El archivo.env es obligatorio: sigue Autoalojar Firecrawl para la configuración del entorno y la invocación de docker compose, y no omitas el release fijado.
Shell
Ideas equivocadas frecuentes
En publicaciones de terceros a veces se afirma lo siguiente. Cada afirmación queda desmentida por la documentación enlazada en la columna de la derecha.El número de estrellas en GitHub, la cantidad de releases y cifras similares cambian continuamente. Esta página no las repite; consulta el repositorio de Firecrawl para ver las cifras actuales.

