PDFtoMarkdown.ai 是一个把 PDF 转成干净 Markdown 的小工具:保留标题层级、表格、OCR 文字和图片,转出来的结果可以直接喂给 Claude、Cursor 等智能体。工具小,但使用频率极高。
工具介绍
它的定位一句话能说清:在把 PDF 交给 AI 之前,先把格式洗干净。直接把 PDF 丢给大模型,常遇到两类问题:一是扫描件识别不了,二是表格和标题层级被拆得乱七八糟,模型理解错、还浪费 token。PDFtoMarkdown.ai 干的就是这个前置清洗活:
转换质量:自动保留标题层级、表格结构、图片和 OCR 文字,输出结构化的干净 Markdown,而不是一堆乱序文本。
三种使用方式:网页版拖拽即用;REST API 可以接进自动化流程;MCP 接口可以让 Claude、Cursor、Codex 这类智能体直接调用——比如让 AI 助手自己把一份合同转成 Markdown 再分析。
零门槛试用:免登录就能免费转 10 页,够你试明白它适不适合你。
它和通用格式转换工具的区别在于输出目标是 AI 工作流:转出来的 Markdown 不是给人排版的,而是给大模型读的——标题层级对应上下文结构、表格保持行列关系、OCR 文字干净无杂质。同样是「转个格式」,喂给 AI 的效果差距很大。

核心功能
1. PDF 转 Markdown
保留标题层级、表格、图片与 OCR 文字,输出结构干净可直接使用。
2. 扫描件 OCR
图片型扫描 PDF 也能识别出文字内容。
3. REST API
批量转换、接入自动化流程,适合固定文档处理管线。
4. MCP 接口
AI 智能体可直接调用,让 Claude/Cursor 自己完成「转换 + 阅读」两步。
5. 免登录试用
免费 10 页不用注册,先试后买。
使用场景
- 合同与报告处理:合同、年报、研报转 Markdown 后再让 AI 分析,准确率明显提升
- 论文阅读:论文转干净 Markdown 丢给 AI 做综述、翻译、笔记
- 喂 AI 前的预处理:比直接喂 PDF 省 token,模型也不会被乱格式带偏
- 知识库建设:批量把 PDF 文档转成 Markdown,进 Obsidian、语雀等知识库
- 开发自动化:用 REST API/MCP 把转换嵌进文档处理管线
哪些人最该用
结合它的能力边界,四类人闭眼入:一是天天让 AI 读文档的人——律师读合同、运营读报告、学生读论文,先转 Markdown 再提问,回答质量和 token 成本都会改善;二是搭知识库的人——Obsidian、语雀、Notion 都吃 Markdown,批量入库靠它;三是做 AI 应用的开发者——REST API 和 MCP 让「PDF 进、结构化文本出」变成一行调用;四是手头一堆扫描件的人——OCR 能力能把图片型 PDF 救回来。反过来,如果你只是偶尔转一页简单文档,系统自带的复制粘贴可能就够了。
价格方案
| 档位 | 价格 | 说明 |
|---|---|---|
| 免费额度 | $0 | 免登录转换 10 页,够试用 |
| 按页计费 | 约 $0.03/页 | 积分制,积分永不过期 |
按页付费对轻度用户很友好:一个月转几十页也就一两美元,不用订阅月费。
上手指南
1. 打开官网:访问 pdftomarkdown.ai,不用注册
2. 拖入 PDF:把文件拖进转换框,直接开始转换
3. 检查结果:重点核对表格和扫描件部分,复杂排版可能有出入
4. 复制/导出:把 Markdown 复制给 Claude、Cursor 或存进知识库
5. 超量再付费:10 页免费额度用完后按页购买,积分不过期
常见问题
为什么不直接把 PDF 喂给 ChatGPT/Claude?
直接喂 PDF 有三个坑:扫描件读不了、表格被拆碎、消耗 token 多。先转成干净 Markdown 再喂,模型理解更准、成本更低。对经常让 AI 读长文档的人,这一步预处理性价比极高。
复杂排版的 PDF 会翻车吗?
极度不规则的排版可能丢格式,超复杂扫描件建议开启 OCR/AI 选项再转。重要文档转完务必人工核对一遍,尤其是表格数字和合同条款。
积分会过期吗?
不会。按页购买的积分永不过期,偶尔用一次的人不用担心浪费。
和 Adobe 导出比优势在哪?
Adobe 导出的是 Word/PPT 等格式,且按月订阅;这个工具专注「PDF→Markdown」一件事,按页付费,且输出直接适配 AI 工作流(MCP 接口是它独有的差异点)。