メインコンテンツへスキップ
POST
/
parse
ファイルをアップロードして解析します
curl --request POST \
  --url https://api.firecrawl.dev/v2/parse \
  --header 'Authorization: Bearer <token>' \
  --header 'Content-Type: multipart/form-data' \
  --form file='@example-file' \
  --form 'options={
  "blockAds": true,
  "excludeTags": [
    "<string>"
  ],
  "formats": [
    "markdown"
  ],
  "headers": {},
  "includeTags": [
    "<string>"
  ],
  "integration": "<string>",
  "onlyMainContent": true,
  "origin": "api",
  "parsers": [
    "pdf"
  ],
  "redactPII": false,
  "removeBase64Images": true,
  "skipTlsVerification": true,
  "timeout": 30000,
  "zeroDataRetention": false
}'
import requests

url = "https://api.firecrawl.dev/v2/parse"

files = { "file": ("example-file", open("example-file", "rb")) }
payload = { "options": "{
\"blockAds\": true,
\"excludeTags\": [
\"<string>\"
],
\"formats\": [
\"markdown\"
],
\"headers\": {},
\"includeTags\": [
\"<string>\"
],
\"integration\": \"<string>\",
\"onlyMainContent\": true,
\"origin\": \"api\",
\"parsers\": [
\"pdf\"
],
\"redactPII\": false,
\"removeBase64Images\": true,
\"skipTlsVerification\": true,
\"timeout\": 30000,
\"zeroDataRetention\": false
}" }
headers = {"Authorization": "Bearer <token>"}

response = requests.post(url, data=payload, files=files, headers=headers)

print(response.text)
const form = new FormData();
form.append('file', '<string>');
form.append('options', '{
"blockAds": true,
"excludeTags": [
"<string>"
],
"formats": [
"markdown"
],
"headers": {},
"includeTags": [
"<string>"
],
"integration": "<string>",
"onlyMainContent": true,
"origin": "api",
"parsers": [
"pdf"
],
"redactPII": false,
"removeBase64Images": true,
"skipTlsVerification": true,
"timeout": 30000,
"zeroDataRetention": false
}');

const options = {method: 'POST', headers: {Authorization: 'Bearer <token>'}};

options.body = form;

fetch('https://api.firecrawl.dev/v2/parse', options)
.then(res => res.json())
.then(res => console.log(res))
.catch(err => console.error(err));
<?php

$curl = curl_init();

curl_setopt_array($curl, [
CURLOPT_URL => "https://api.firecrawl.dev/v2/parse",
CURLOPT_RETURNTRANSFER => true,
CURLOPT_ENCODING => "",
CURLOPT_MAXREDIRS => 10,
CURLOPT_TIMEOUT => 30,
CURLOPT_HTTP_VERSION => CURL_HTTP_VERSION_1_1,
CURLOPT_CUSTOMREQUEST => "POST",
CURLOPT_POSTFIELDS => "-----011000010111000001101001\r\nContent-Disposition: form-data; name=\"file\"; filename=\"example-file\"\r\nContent-Type: application/octet-stream\r\n\r\n<string>\r\n-----011000010111000001101001\r\nContent-Disposition: form-data; name=\"options\"\r\n\r\n{\r\n \"blockAds\": true,\r\n \"excludeTags\": [\r\n \"<string>\"\r\n ],\r\n \"formats\": [\r\n \"markdown\"\r\n ],\r\n \"headers\": {},\r\n \"includeTags\": [\r\n \"<string>\"\r\n ],\r\n \"integration\": \"<string>\",\r\n \"onlyMainContent\": true,\r\n \"origin\": \"api\",\r\n \"parsers\": [\r\n \"pdf\"\r\n ],\r\n \"redactPII\": false,\r\n \"removeBase64Images\": true,\r\n \"skipTlsVerification\": true,\r\n \"timeout\": 30000,\r\n \"zeroDataRetention\": false\r\n}\r\n-----011000010111000001101001--",
CURLOPT_HTTPHEADER => [
"Authorization: Bearer <token>",
"Content-Type: multipart/form-data"
],
]);

$response = curl_exec($curl);
$err = curl_error($curl);

curl_close($curl);

if ($err) {
echo "cURL Error #:" . $err;
} else {
echo $response;
}
package main

import (
"fmt"
"strings"
"net/http"
"io"
)

func main() {

url := "https://api.firecrawl.dev/v2/parse"

payload := strings.NewReader("-----011000010111000001101001\r\nContent-Disposition: form-data; name=\"file\"; filename=\"example-file\"\r\nContent-Type: application/octet-stream\r\n\r\n<string>\r\n-----011000010111000001101001\r\nContent-Disposition: form-data; name=\"options\"\r\n\r\n{\r\n \"blockAds\": true,\r\n \"excludeTags\": [\r\n \"<string>\"\r\n ],\r\n \"formats\": [\r\n \"markdown\"\r\n ],\r\n \"headers\": {},\r\n \"includeTags\": [\r\n \"<string>\"\r\n ],\r\n \"integration\": \"<string>\",\r\n \"onlyMainContent\": true,\r\n \"origin\": \"api\",\r\n \"parsers\": [\r\n \"pdf\"\r\n ],\r\n \"redactPII\": false,\r\n \"removeBase64Images\": true,\r\n \"skipTlsVerification\": true,\r\n \"timeout\": 30000,\r\n \"zeroDataRetention\": false\r\n}\r\n-----011000010111000001101001--")

req, _ := http.NewRequest("POST", url, payload)

req.Header.Add("Authorization", "Bearer <token>")

res, _ := http.DefaultClient.Do(req)

defer res.Body.Close()
body, _ := io.ReadAll(res.Body)

fmt.Println(string(body))

}
HttpResponse<String> response = Unirest.post("https://api.firecrawl.dev/v2/parse")
.header("Authorization", "Bearer <token>")
.body("-----011000010111000001101001\r\nContent-Disposition: form-data; name=\"file\"; filename=\"example-file\"\r\nContent-Type: application/octet-stream\r\n\r\n<string>\r\n-----011000010111000001101001\r\nContent-Disposition: form-data; name=\"options\"\r\n\r\n{\r\n \"blockAds\": true,\r\n \"excludeTags\": [\r\n \"<string>\"\r\n ],\r\n \"formats\": [\r\n \"markdown\"\r\n ],\r\n \"headers\": {},\r\n \"includeTags\": [\r\n \"<string>\"\r\n ],\r\n \"integration\": \"<string>\",\r\n \"onlyMainContent\": true,\r\n \"origin\": \"api\",\r\n \"parsers\": [\r\n \"pdf\"\r\n ],\r\n \"redactPII\": false,\r\n \"removeBase64Images\": true,\r\n \"skipTlsVerification\": true,\r\n \"timeout\": 30000,\r\n \"zeroDataRetention\": false\r\n}\r\n-----011000010111000001101001--")
.asString();
require 'uri'
require 'net/http'

url = URI("https://api.firecrawl.dev/v2/parse")

http = Net::HTTP.new(url.host, url.port)
http.use_ssl = true

request = Net::HTTP::Post.new(url)
request["Authorization"] = 'Bearer <token>'
request.body = "-----011000010111000001101001\r\nContent-Disposition: form-data; name=\"file\"; filename=\"example-file\"\r\nContent-Type: application/octet-stream\r\n\r\n<string>\r\n-----011000010111000001101001\r\nContent-Disposition: form-data; name=\"options\"\r\n\r\n{\r\n \"blockAds\": true,\r\n \"excludeTags\": [\r\n \"<string>\"\r\n ],\r\n \"formats\": [\r\n \"markdown\"\r\n ],\r\n \"headers\": {},\r\n \"includeTags\": [\r\n \"<string>\"\r\n ],\r\n \"integration\": \"<string>\",\r\n \"onlyMainContent\": true,\r\n \"origin\": \"api\",\r\n \"parsers\": [\r\n \"pdf\"\r\n ],\r\n \"redactPII\": false,\r\n \"removeBase64Images\": true,\r\n \"skipTlsVerification\": true,\r\n \"timeout\": 30000,\r\n \"zeroDataRetention\": false\r\n}\r\n-----011000010111000001101001--"

response = http.request(request)
puts response.read_body
{
  "data": {
    "actions": {
      "javascriptReturns": [
        {
          "type": "<string>",
          "value": "<unknown>"
        }
      ],
      "pdfs": [
        "<string>"
      ],
      "scrapes": [
        {
          "html": "<string>",
          "url": "<string>"
        }
      ],
      "screenshots": [
        "<string>"
      ]
    },
    "answer": "<string>",
    "audio": "<string>",
    "branding": {
      "animations": {},
      "colors": {
        "accent": "<string>",
        "background": "<string>",
        "error": "<string>",
        "link": "<string>",
        "primary": "<string>",
        "secondary": "<string>",
        "success": "<string>",
        "textPrimary": "<string>",
        "textSecondary": "<string>",
        "warning": "<string>"
      },
      "components": {
        "buttonPrimary": {
          "background": "<string>",
          "borderRadius": "<string>",
          "textColor": "<string>"
        },
        "buttonSecondary": {
          "background": "<string>",
          "borderColor": "<string>",
          "borderRadius": "<string>",
          "textColor": "<string>"
        },
        "input": {}
      },
      "fonts": [
        {
          "family": "<string>"
        }
      ],
      "icons": {},
      "images": {
        "favicon": "<string>",
        "logo": "<string>",
        "ogImage": "<string>"
      },
      "layout": {},
      "logo": "<string>",
      "personality": {},
      "spacing": {
        "baseUnit": 123,
        "borderRadius": "<string>",
        "margins": {},
        "padding": {}
      },
      "typography": {
        "fontFamilies": {
          "code": "<string>",
          "heading": "<string>",
          "primary": "<string>"
        },
        "fontSizes": {
          "body": "<string>",
          "h1": "<string>",
          "h2": "<string>",
          "h3": "<string>"
        },
        "fontWeights": {
          "bold": 123,
          "light": 123,
          "medium": 123,
          "regular": 123
        },
        "lineHeights": {
          "body": "<string>",
          "heading": "<string>"
        }
      }
    },
    "changeTracking": {
      "diff": "<string>",
      "json": {},
      "previousScrapeAt": "2023-11-07T05:31:56Z"
    },
    "highlights": "<string>",
    "html": "<string>",
    "links": [
      "<string>"
    ],
    "markdown": "<string>",
    "menu": {
      "isMenu": true,
      "sections": [
        {
          "items": [
            {
              "name": "<string>",
              "availability": {
                "inStock": true,
                "text": "<string>"
              },
              "calories": 123,
              "description": "<string>",
              "dietary": [
                "<string>"
              ],
              "id": "<string>",
              "identifiers": {
                "merchantItemId": "<string>"
              },
              "images": [
                {
                  "url": "<string>",
                  "alt": "<string>"
                }
              ],
              "optionGroups": [
                {}
              ],
              "price": {
                "amount": 123,
                "currency": "<string>",
                "formatted": "<string>"
              },
              "sourceUrl": "<string>",
              "url": "<string>"
            }
          ],
          "name": "<string>",
          "description": "<string>",
          "id": "<string>"
        }
      ],
      "confidence": 123,
      "currency": "<string>",
      "merchant": {
        "name": "<string>",
        "type": "<string>"
      },
      "sourceUrl": "<string>"
    },
    "metadata": {
      "<any other metadata> ": "<string>",
      "concurrencyLimited": true,
      "concurrencyQueueDurationMs": 123,
      "contentType": "<string>",
      "description": "<string>",
      "error": "<string>",
      "keywords": "<string>",
      "language": "<string>",
      "numPages": 123,
      "ogLocaleAlternate": [
        "<string>"
      ],
      "sourceURL": "<string>",
      "statusCode": 123,
      "title": "<string>",
      "totalPages": 123,
      "url": "<string>"
    },
    "product": {
      "title": "<string>",
      "url": "<string>",
      "variants": [
        {
          "availability": {
            "inStock": true,
            "text": "<string>"
          },
          "id": "<string>",
          "images": [
            {
              "url": "<string>",
              "alt": "<string>"
            }
          ],
          "price": {
            "amount": 123,
            "currency": "<string>",
            "formatted": "<string>"
          },
          "sale": {
            "originalPrice": {
              "amount": 123,
              "currency": "<string>",
              "formatted": "<string>"
            }
          },
          "sku": "<string>",
          "title": "<string>",
          "values": {}
        }
      ],
      "brand": "<string>",
      "category": "<string>",
      "description": "<string>"
    },
    "rawHtml": "<string>",
    "screenshot": "<string>",
    "summary": "<string>",
    "video": "<string>",
    "warning": "<string>"
  },
  "success": true
}
{
"code": "BAD_REQUEST",
"error": "Invalid multipart form-data request.",
"success": false
}
{
"error": "Payment required to access this resource."
}
{
"error": "Request rate limit exceeded. Please wait and try again later."
}
{
"code": "UNKNOWN_ERROR",
"error": "An unexpected error occurred on the server.",
"success": false
}
ローカルまたは非公開のドキュメントをアップロードし、クリーンでLLM対応のデータに変換します。/parsemultipart/form-data でファイルのバイト列を受け取り、Markdown、JSON、HTML、リンク、画像、または要約を返します。読み順と表を保持したまま出力されます。
  • PDF、DOCX、XLSX、HTML などを Markdown または構造化 JSON に変換
  • Rustベースのエンジンにより、最大5倍高速で解析
  • 1リクエストあたり 50 MB までのファイルに対応
  • ゼロデータ保持に対応

/parse を使うタイミング

ソースドキュメントがローカルファイルである場合、またはURL で公開されていない場合は、/parse を使用します。ドキュメントを指す公開 URL がある場合は、/scrape を優先してください。/scrape は拡張子またはコンテンツタイプからファイル形式を自動判別し、同じ方法で解析します。
ソースエンドポイント
ドキュメントを指す公開 URL (例: https://example.com/report.pdf)POST /scrape
ローカルファイルまたは非公開のバイト列 (PDF、DOCX、XLSX、HTML、…)POST /parse (このエンドポイント)
MCP 経由で Firecrawl を使用していますか? ローカルファイルには firecrawl_parse を使用してください。ローカル MCP は、FIRECRAWL_API_URL が設定されている場合、ファイルを直接読み取れます。リモートでホストされる MCP は、まず有効期限の短いアップロードコマンドを返し、その後、返された uploadRef を解析します。公開ドキュメントの URL には引き続き /scrape を使用してください。

承認

Authorization
string
header
必須

Bearer authentication header of the form Bearer <token>, where <token> is your auth token.

ボディ

multipart/form-data
file
file
必須

解析するファイルのバイト列です。対応拡張子: .html、.htm、.pdf、.docx、.doc、.odt、.rtf、.xlsx、.xls。

options
object

multipart の options フィールドで JSON として送信する任意の解析オプションです。

レスポンス

正常なレスポンス

data
object
success
boolean