PDF 转 Markdown
把 PDF 转成干净的 Markdown,直接粘进 Obsidian、Notion、wiki 或 Git 仓库。文件不会上传。
文件不会离开你的设备
把文件拖到这里
或点击选择文件
工作原理
这个工具把 PDF 转成 Markdown——Obsidian、Notion、GitHub README 和大多数静态站点生成器背后的纯文本格式。它在浏览器里读取 PDF 的文字层,判断哪些行是标题、哪些是正文,把被换行和分页拆开的段落重新拼回去,去掉重复出现的页眉页脚,最后生成一个可以下载或直接复制到剪贴板的 .md 文件。
能保留的:标题(按相对字号判断)、段落,以及项目符号和编号列表。不能保留的:PDF 本身并不知道什么是表格、什么是分栏——它只存放定位好的字形——所以表格、多栏排版和图片会被压平成纯文本,可能需要你手动整理。可选的 YAML front matter 会写入标题、作者、来源文件名和页数,方便笔记软件和站点生成器使用。如果某页是没有文字层的扫描件,可以用本机 OCR 识别并追加到文末。
一切都在本地进行:你的 PDF 在浏览器里解析和转换,生成的 Markdown 从不经过服务器。不上传、不注册、无水印、不限页数——适合合同、草稿、论文,以及任何你不想交给云端转换器的文件。你可以打开网络面板确认文件从未离开设备。
常见问题
会保留表格和图片吗?
不会。PDF 存的是定位好的字形而不是表格结构,仅凭文字层无法可靠地还原成 Markdown 表格,表格里的文字会以普通段落的形式出现。图片也不会提取——这个工具专注于正文。如果你需要页面图片,请用「PDF 转 JPG」。
能转扫描型 PDF 吗?
能,靠 OCR。扫描件只是图片,没有可读的文字层。工具会标出扫描页并提示你在设备上运行 OCR(英文),识别出的文字会追加到 Markdown 末尾。会慢一些——每页几秒——但什么都不上传。
标题是怎么识别的?
按相对字号:明显比正文大的行会变成 # 一级标题,稍大一些的变成 ## 二级标题。对排版规范的报告、论文和书籍效果很好;如果 PDF 里的标题和正文一样大、只是加粗,识别效果会差一些。转换后你随时可以在 Markdown 里改标题层级。