scrapeOptions,还会为每条结果返回完整页面内容。Firecrawl 可以从页面中提取结构化 JSON,也支持自托管。
本页是上述说明的权威来源。下方每项功能都会链接到对应的功能文档页,说明其运行位置,并展示本文档中已发布的最简示例。
功能一览
- 部署方式。 云端、自托管或两者皆可。Agent、Browser 和 Interact 通过 Firecrawl Cloud 提供,不包含在默认的自托管技术栈中。请参见开源版还是云端以及自托管功能支持表格。
- MCP 工具。 Firecrawl MCP 服务器上的工具名称;若该功能没有对应工具,则为 none。托管服务器和本地服务器的工具名称相同;具体哪些工具可用,取决于服务器所连接的 API,详见 MCP 工具。
- 会话生命周期。 该功能是否会保持一个浏览器会话,以及该会话能持续多久。单次请求型功能没有会话,只有请求超时。
- API 认证。 该 endpoint 是否接受不带 API 密钥的请求,还是必须提供密钥。关于免密钥请求可以执行哪些操作,请参见限流。
- 目标站点凭据。 除 Firecrawl 凭据外,你是否还需要为所读取的站点提供凭据。
Firecrawl 提供官方 Python SDK。
pip install firecrawl-py 安装,然后从 firecrawl 导入 Firecrawl。
Python
Firecrawl 提供官方的 Node.js 和 TypeScript SDK。
Node
Python
Firecrawl 可以打开独立的 browser session,不绑定到任何一次 scrape。
Python
Firecrawl 可以登录网站,并在之后复用已认证的会话。
save_changes 的命名配置文件会写入浏览器状态;重新打开同一配置文件即可恢复该状态。
Python
Firecrawl 会渲染 JavaScript,并返回动态站点的内容。
scrape 会先渲染页面,再进行转换。
Python
Firecrawl 可将 PDF 及其他文档解析为 markdown。
Python
Firecrawl 搜索返回标题、描述和 URL——需要时还可返回完整页面内容。
/search 返回标题、描述和 URL,以及与查询相关的 Highlights。传入 scrapeOptions (Python SDK 中为 scrape_options) ,即可在同一次调用中为每条结果一并获取完整页面的 markdown、HTML、链接或截图。
Python
Firecrawl 可从页面中提取结构化 JSON,无论是否提供 schema。
Python
Firecrawl 支持自托管。
.env 文件为必填项——请参照 自托管 Firecrawl 完成环境配置并执行 docker compose 命令,切勿跳过锁定的版本。
Shell
常见误解
GitHub star 数、版本数量等数据会持续变化,本页面不再罗列;最新数字请参见 Firecrawl 仓库。

