Parse
Envie um documento local ou não público e converta-o em dados limpos, prontos para LLM. O /parse aceita os bytes do arquivo via multipart/form-data e retorna Markdown, JSON, HTML, links, imagens ou um resumo — com a ordem de leitura e as tabelas preservadas.
- Converta PDF, DOCX, XLSX, HTML e outros formatos em Markdown ou JSON estruturado
- Análise até 5x mais rápida com um mecanismo baseado em Rust
- Arquivos de até 50 MB por solicitação
- Suporte a Zero Data Retention
Use /parse quando o documento de origem for um arquivo local ou não estiver acessível publicamente por URL. Se você tiver uma URL pública que aponte para um documento, prefira /scrape — ele detecta automaticamente o tipo de arquivo pela extensão ou pelo tipo de conteúdo e faz o parsing da mesma forma.
| Origem | Endpoint |
|---|---|
URL pública para um documento (por exemplo, https://example.com/report.pdf) | POST /scrape |
| Arquivo local ou bytes não públicos (PDF, DOCX, XLSX, HTML, …) | POST /parse (este endpoint) |
Usando o Firecrawl via MCP? Use firecrawl_parse para arquivos locais. O MCP local pode ler o arquivo diretamente quando configurado com FIRECRAWL_API_URL. O MCP remoto hospedado primeiro retorna um comando de upload temporário e, em seguida, faz o parsing do uploadRef retornado. URLs públicas de documentos ainda devem usar /scrape.