可用工具
1. 抓取工具 (firecrawl_scrape)
redactPII。
2. Map 工具 (firecrawl_map)
Map 工具选项:
url:要映射的网站基础 URLsearch:用于筛选 URL 的可选搜索词sitemap:控制 sitemap 的使用方式:“include”、“skip”或“only”includeSubdomains:映射时是否包含子域名limit:返回的最大 URL 数量ignoreQueryParameters:映射时是否忽略查询参数
3. 搜索工具 (firecrawl_search)
Search Tool 选项:
query:搜索查询字符串 (必填)limit:返回结果的最大数量location:搜索结果的地理位置tbs:基于时间的搜索筛选条件 (例如,qdr:d表示过去一天,qdr:w表示过去一周,qdr:m表示过去一个月)filter:附加搜索筛选条件sources:要搜索的来源类型数组 (web、images、news)scrapeOptions:用于抓取搜索结果页面的选项enterprise:企业选项数组 (default、anon、zdr)
4. Parse Tool (firecrawl_parse)
FIRECRAWL_API_URL 在本地针对 Firecrawl API 实例运行 Firecrawl MCP 时,MCP 服务器可以直接读取 filePath,并将文件字节发送到 /v2/parse。
使用远程托管的 MCP 服务器时,托管服务器无法读取你机器上的文件。在这种情况下,firecrawl_parse 会采用两步交接流程,该流程同样适用于远程免密钥 URL:
- 使用
filePath调用firecrawl_parse。该工具会返回一条预填充的上传命令,以及包含uploadRef的nextToolCall。 - 在能够读取该文件的机器上运行上传命令,然后使用返回的
uploadRef再次调用firecrawl_parse。
Parse Tool 选项:
filePath:要解析的本地文件路径。首次调用时使用。uploadRef:首次托管 MCP 调用返回的引用。上传成功后,第二次调用时使用。formats:输出格式。默认值为markdown。parsers:解析器控制选项,例如 PDF 解析选项。contentType:可选的文件 MIME 类型覆盖设置。declaredSizeBytes:可选的文件大小提示。文件大小上限为 50 MB。
firecrawl_scrape;它会检测并解析 URL 中的文档。
5. 爬取工具 (firecrawl_crawl)
6. 查看爬取状态 (firecrawl_check_crawl_status)
7. 提取工具 (firecrawl_extract)
Extract Tool 选项:
urls: 用于提取信息的 URL 数组prompt: 用于 LLM 提取的自定义 promptschema: 用于提取结构化数据的 JSON schemaallowExternalLinks: 允许从外部链接中提取信息enableWebSearch: 启用网页搜索以获取额外上下文includeSubdomains: 提取时包含子域名
8. 代理工具 (firecrawl_agent)
firecrawl_agent_status 检查任务何时完成并获取结果。
代理工具选项:
prompt:所需数据的自然语言描述 (必填,最多 10,000 个字符)urls:可选的 URL 数组,用于让代理聚焦于特定页面schema:用于结构化输出的可选 JSON schema
firecrawl_agent_status 轮询获取结果。
9. 检查代理状态 (firecrawl_agent_status)
代理状态选项:
id:firecrawl_agent返回的代理任务 ID (必填)
processing:代理仍在调研中 — 继续轮询completed:调研已完成 — 响应中包含提取的数据failed:发生错误
10. 与页面交互 (firecrawl_interact)
- 传入
url,即可在一次 MCP 调用中打开新页面并与其交互。 - 传入之前
firecrawl_scrape调用返回的scrapeId,以复用已加载的页面。
url 和 scrapeId。请提供 prompt 或 code 其中之一。scrapeOptions 仅可在 url 模式下使用。
URL 模式示例:
交互工具选项:
url:要交互的页面;系统会为您打开会话。使用此项或scrapeId。scrapeId:此前调用firecrawl_scrape返回的抓取任务 ID。使用此项或url。prompt:描述要执行操作的自然语言指令。提供prompt或code。code:在浏览器会话中执行的代码。提供code或prompt。language:bash、python或node(可选,默认值为node,仅与code配合使用) 。timeout:执行超时时间 (秒) ,范围为 1–300 (可选,默认值为 30) 。scrapeOptions:仅在url模式下使用的可选抓取控制选项。
11. 停止交互会话 (firecrawl_interact_stop)
交互停止选项:
scrapeId:要停止的会话对应的抓取 ID (必填)
日志系统
- 操作状态和进度
- 性能指标
- 额度使用情况监控
- 限流跟踪
- 错误情况
错误处理
- 自动重试瞬时错误
- 通过退避策略处理限流
- 提供详细的错误信息
- 额度使用警告
- 网络容错能力

