把PDF转成Markdown

或拖到这里
请先选择一个PDF。

不上传把原生文字PDF转成经核验的Markdown。工具读文字层,按阅读顺序重建行,推断简单标题列表代码,再拿Markdown跟留下的文字比对。纯图扫描件先要OCR,有可选文字的文件从下面选择PDF开始。

把PDF转成Markdown

  1. 选择PDF

    点选择PDF,或把文件拖放到页面上。文件全在本浏览器标签页里打开和读取。

  2. 选分页和重复文字

    每PDF页留个记号,或让文字合成一篇连续文档。工具能安全认出的重复页眉页脚自动去掉。

  3. 转换文字

    工具读原生文字层,按阅读顺序重建行,用字号和字体信息推断简单标题、列表和代码块。

  4. 检查并下载

    生成的Markdown读回,跟PDF留下的文字比对:页面记号和顺序必须成立,留下的文字必须通过留存检查且无编码错。核验失败不产出下载。

PDF转Markdown能保留什么

PDF把文字记在页面位置上,Markdown记阅读顺序和少量结构。本工具把原生文字拼成行,要就留页界,用字号和字体信息推断简单标题、列表和代码块。分栏、复杂表格、脚注、视觉排版,不敢说原样复刻。

纯图扫描件没有文字层可提,工具拒收,不給空Markdown下载。OCR是另个活,猜出的文字要自己的准确度量和人工复核。下载是md扩展名的纯文本,任何Markdown编辑器、wiki、笔记应用直接打开。

什么时候需要把PDF转Markdown

PDF文档转Markdown适配好几种工作流。以下情况用浏览器端PDF转Markdown就是对的工具:

反向把Markdown转成PDF,用 Markdown转PDF。单提表格,请试试 PDF转CSVPDF转Excel。要页面图不要文字,用 PDF转图片.

为什么浏览器端PDF转Markdown重要

把PDF传给远端转换器,研究论文、法律文档、内部报告穿过第三方系统。这些文件不想出设备,在这里转。

本页整个转换在您的浏览器里跑:PDF打开、文字提取、Markdown生成核验,文件不出设备。不用注册,任何服务器不留数据。机密研究、专有文档、敏感内报放心用。

核验这步加信任。生成的Markdown读回,可见非空字符数跟工具留下的PDF文字比对。留下的文字必须通过留存检查,编码问题的替换字符拒收。核验失败,没下载,不给坏文件。

PDF转Markdown常见问题

PDF转Markdown上传我的文件吗?
不会。PDF打开、转换、检查、预览,全在本浏览器标签页。文件从不出您的设备。
扫描版PDF行吗?
还不行。本版要可选文字。纯图扫描件变Markdown先要OCR。工具拒收扫描件,不产空文件。
Markdown跟PDF长得一模一样吗?
不。PDF存定位页面内容,Markdown存阅读顺序和简单结构。工具保住文字,PDF证据够就推断标题、列表和代码块。分栏、表格、脚注这类复杂版式未必完美迁移。
页面记号长什么样?
每页开头一句Markdown注释如Page 3。注释留住页界,渲染不成可见内容。
重复页眉页脚会怎样?
同一短行跨页出现在同样页边附近,工具能去掉。去掉了几个,回执写明。
预览渲染链接或HTML吗?
不。Markdown预览按纯文本展示。不渲染HTML,不跟链接,不加载图片。安全起见,预览也快。
文字核验能证明什么?
工具读回Markdown字节,可见非空字符数跟留下的PDF文字比对。留下的文字必须通过留存检查,编码问题的替换字符拒收。核验失败就没有下载。
Markdown能转回PDF吗?
可以。用 Markdown转PDF 工具把Markdown渲染成经核验的PDF,文字可选,带页码和版式选项。

其他pdfgym工具

pdfgym有30多款PDF工具,都在浏览器标签页中运行,不需要帐户。