PDF 转 Markdown
将 PDF 的文字提取为干净的 Markdown,标题和列表一并保留。
如何使用 PDF 转 Markdown
- 上传你的 PDF(也可一次上传多个)。
- 点击“转换为 Markdown”。
- 下载 .md 文件。
关于 PDF 转 Markdown
此工具读取 PDF 的文本层,并将其返回为 Markdown——文档站点、笔记应用、GitHub、维基和静态网站生成器都在使用的轻量格式。它从文件中提取真实字符,再套用合理的启发式规则:短的独立行会变成标题,项目符号样式的行会变成列表项,带编号的行则保留为有序列表,于是你得到的是有结构的 Markdown,而不是一整块平铺的文字。
当你想把 PDF 内容引入 Markdown 工作流,又不必手动重新打字和排版时,它能实实在在地节省时间。一次上传多个文件,逐个下载。所有内容都在我们的服务器上以随机名称处理,请求一结束即被删除——不做存储,也没有水印。
值得先说清楚的一点:PDF 本身并不存储 Markdown,因此结构是推断出来的,并不完美——事后你可能想稍微整理一两个标题。扫描的、纯图片的 PDF 没有可读取的文字,需要 OCR。若想要不做任何猜测的平铺输出,请使用 PDF 转文本。若要把 Markdown 反向转回 PDF,请参见 Markdown 转 PDF。
常见问题
Markdown 结构的准确度如何?
标题和列表是根据文字布局推断出来的,因此它是一个很好的起点,但并非完美无缺。事后快速检查一遍是个好主意。
它对扫描版 PDF 有效吗?
无效。扫描页面是图片,没有文本层,因此没有可提取的内容。它们需要先经过 OCR 软件处理。
我可以一起转换多个 PDF 吗?
可以。上传多个,每个都会生成各自的 .md 文件,既有单独下载,也有“全部下载”选项。

