解析
上传本地或非公开文档,并将其转换为整洁、可供 LLM 使用的数据。/parse 通过 multipart/form-data 接收文件二进制内容,并返回 Markdown、JSON、HTML、链接、图像或摘要——同时保留阅读顺序和表格。
- 将 PDF、DOCX、XLSX、HTML 等转换为 Markdown 或结构化 JSON
- 借助基于 Rust 的引擎,解析速度最高可提升 5 倍
- 单次请求最多支持 50 MB 的文件
- 支持零数据保留
当源文档是本地文件或无法通过公开 URL 访问时,请使用 /parse。如果你有一个指向文档的公开 URL,建议优先使用 /scrape——它会根据扩展名或内容类型自动识别文件类型,并以相同方式解析。
| 来源 | 端点 |
|---|---|
指向文档的公开 URL (例如 https://example.com/report.pdf) | POST /scrape |
| 本地文件或非公开字节流 (PDF、DOCX、XLSX、HTML 等) | POST /parse (此端点) |
通过 MCP 使用 Firecrawl? 对于本地文件,请使用 firecrawl_parse。配置了 FIRECRAWL_API_URL 时,本地 MCP 可以直接读取文件。远程托管的 MCP 会先返回一个短期有效的上传命令,然后再解析返回的 uploadRef。公开文档 URL 仍应使用 /scrape。
Was this page helpful?Suggest editsRaise issue