为什么需要
出海做 AI 产品经常要把用户上传的文档(合同、报告、PPT、Excel 表格)喂给 LLM 做分析、问答或摘要。手动复制粘贴耗时,写爬虫只对网页有用。Anydoc 是 Firecrawl 团队出的本地文档转 Markdown 工具,把 Word、PPT、Excel、PDF、EPUB、RTF、OpenDocument、CSV 等 14 种格式统一转成 GitHub Flavored Markdown。LLM 拿到的是结构化数据(标题层级、表格、列表、代码块、链接、注释),不是无意义的纯文本。
同类工具(markitdown、pandoc、mammoth、unstructured、docling、libreoffice)支持 1-12 种格式,速度慢 12-260 倍。Anydoc 是唯一覆盖全部 14 种格式的工具,质量评分 81(第二名 mammoth 70),中位转换耗时 4.4ms(第二名 mammoth 52.5ms)。
怎么用
Agent Skill 一键接入:
npx skills add firecrawl/anydoc
Claude Code、Codex、Cursor、OpenCode 都能直接调用。
CLI 一行:
npx @firecrawl/anydoc report.docx # 输出到 stdout
npx @firecrawl/anydoc slides.pptx -o slides.md # 输出到文件
Python 绑定:
import anydoc
markdown = anydoc.to_markdown("report.docx")
Node.js / WASM / Rust 绑定也都有,跨平台支持完善。
使用案例
独立开发者做海外 AI 客服 SaaS,用户上传 PDF 合同和 PPT 产品手册让 AI 助手查询。Anydoc 把这些文档批量转成 Markdown 喂给 RAG 系统,比调云端 OCR API 便宜 90%,速度还快。本地处理,敏感文档不出服务器。
出海做内容平台的独立开发者,把用户上传的 EPUB 电子书、Word 投稿转成结构化 Markdown 入库做 AI 推荐,比雇人工处理每天省 3 小时。
另一个场景:给 Claude Code、Codex 配 Anydoc Skill,AI Agent 自动读项目里的合同、需求文档、PPT 提案,不用手动转换。
注意事项
- MIT 协议,开源免费
- 中位转换 4.4ms,单文档处理毫秒级
- 14 种格式全覆盖,质量评分 81 业界最高
- 文本型 PDF 本地处理,扫描件 PDF 需要 OCR(用 Firecrawl Parse 云端服务补)
- 加密文件、纯图片 PDF 不支持
- 与同类对比:markitdown 仅 6 种格式,pandoc 仅 5 种,libreoffice 速度慢 250 倍
- 同公司产品:Firecrawl(网页抓取 API)、Firecrawl Parse(云端 OCR + 文档转换)