看清PDF为什么大

或拖到这里
请先选择一个PDF。

精确看清PDF字节花在哪,不上传,不改动。工具沿文档图走,把图片、字体程序、内容流对到用它们的页面。报告分开图片、字体、页面内容、元数据、嵌入文件、老对象、文件结构,总数跟源文件对上,点名最值得改的一处。PDF留本浏览器标签页,文件从不上传,不用帐户。

找出PDF为什么大

  1. 选择PDF

    点选择PDF,或扔到页面上。文件留本浏览器标签页。

  2. 遍历PDF对象

    工具沿文档图走,把图片、字体程序、内容流对到用它们的页面。

  3. 对上每个字节

    解析对象尺寸摊到物理文件。头、索引等外壳单列一类,看得见。

  4. 检查并行动

    看最大对象,按真占地方的部分跟一条建议。

数字什么意思

每个数字都是存下字节数,不是解码数。JPEG解码成几兆像素,存下远没那么多,报告只说文件里有什么。对象头、交叉引用数据、尾部单列一类,不悄悄摊到别类,类别加外壳必须等于源字节数。对不上,报错不报数。

PDF解析器规整对象语法和对象流,解析尺寸摊回物理文件。压缩前先分析文件大小:分析点名占字节的类别,下表说压缩动不动得了它。

每个大小类别统计什么

每个大小类别统计什么,压缩能否减小它
类别统计什么压缩动得了它
图片统计什么照片扫描Logo按存下大小,不按解码像素数。 压缩动得了它 是。 压缩PDF 按150 DPI重编码置入图片。
字体统计什么嵌入字体程序。整套字体一页画12个字形和画1200个一样贵。 压缩动得了它 部分行。 仅TrueType 字体这路把嵌入的TrueType子集化到页面用的字形。Type 1和CFF程序不动。
页面内容统计什么每页绘画指令:文字段、矢量图、位置。 压缩动得了它 部分行。 很少 这里数字大指向矢量图而非文字,文字段都很小。
嵌入文件统计什么PDF里带的附件,比如图表出自的那个表格。 压缩动得了它 否。 附件删掉,不然字节留着。
元数据统计什么XMP包、文档信息和生产者痕迹。 压缩动得了它 否。 删除PDF元数据 为隐私清它;为体积,另请高明。
无引用对象统计什么之前保存留下的对象,当前文档够不着了。 压缩动得了它 部分行。 通常 干净另存能扔掉它们,也可能让数字签名失效。
PDF结构统计什么页面树、大纲、注释和表单字段定义。 压缩动得了它 否。 文档是什么的固定成本,跟怎么存的无关。
文件外壳统计什么对象头、交叉引用数据和尾部。 压缩动得了它 否。 解析器分不下去的外壳剩头:头、交叉引用数据、尾部。

分析报告拆分,不重写PDF。

压缩前什么时候先分析PDF

大小分析是动手前的诊断步。PDF太大发不出去、手机上打开慢,先问空间被谁占。一个40MB图加2MB文字的报告,跟1MB图加40MB嵌入字体的报告,药方不同。分析点名类别,建议指向动字节最多的那一改。

图片超标, 压缩PDF 按目标DPI重编码置入图片。整套嵌入的字体本可用子集,重建源文档是正解。修完再跑一遍分析,确认总数下去。

答案拿来干什么?

分析是诊断,不是药。知道哪些图片字体内容流占分量, 如何压缩PDF 讲常规路线, 无损压缩PDF 讲什么能无感减小、什么不能。

PDF大小分析问题

大小分析会改我的PDF吗?
不会。本工具读文件出报告,不写新PDF。
各类别加起来正好等于文件大小吗?
有。回执检查类别加文件外壳精确等于源字节数。对不上,报错,不报错误总数。
文件外壳为什么单列一类?
PDF还有对象头、交叉引用数据、尾部等物理外壳。解析对象留不住每个原始字节偏移,差额单列,不藏。
能告诉我哪张图大吗?
有。最大对象清单含页面位置、像素尺寸、置入DPI和编码(有的话)。
大小分析上传我的PDF吗?
不会。PDF对象图、页面匹配、大小报告,都留本浏览器标签页。
结果拿来干什么?
从报告点的那一改开始。通常是一张超标图,或本可用子集却整套嵌入的字体。前者用压缩PDF,后者从源重建文档。修完再跑一遍分析,看类别动没动。
为什么我的PDF页面内容类这么大?
页面内容流是每页的绘画指令。数值大通常是矢量图,文字段都很小。这些流已经压过,压缩动它们够呛。
带密码的PDF能看分析吗?
先解锁PDF。工具读对象图,要看未加密结构。

继续处理您的PDF

这个分析阅读器在您的浏览器里跑:PDF不上传,报告不改文件分毫。下面的工具各自在自己的浏览器标签页里跑。

接下来去哪里