为什么我的 PDF 这么大(怎么解决)
3 页的 PDF 不该有 20MB。本文拆解 5 个真实原因——高分辨率扫描、未压缩照片、内嵌字体、重复资源、隐藏数据——并给出每一种的浏览器本地解法。
原因 1–2:扫描件和照片(九成情况)
一页 300–600 DPI 的彩色扫描就是一张巨大的图片,几页就能几十 MB。同理,Word 里插了手机原图再导出 PDF,每张照片都以相机全分辨率存进文件——哪怕显示出来只有缩略图大小。
解法:带图片降采样的压缩。在阅读尺寸下,把这些图片重编码到屏幕分辨率基本看不出差别,通常能砍掉 50–90% 的体积。
原因 3–4:内嵌字体与重复资源
整套中文字体内嵌进文档,一个就能增加好几 MB;从不同来源合并的 PDF 还可能把同一张图、同一套字体重复存了多份。这两个原因不如图片常见,但正好解释「纯文字的 PDF 为什么还有 8MB」。
原因 5:隐藏数据
删除但仍保留的对象、内嵌缩略图、元数据和编辑痕迹都会留在文件里。压缩时重建文档会丢弃未引用的对象;如果担心隐私,还可以用元数据编辑工具查看并清除文档元数据(含 XMP)。
不确定是哪个原因?直接跑一次压缩工具:处理前的预估(本地计算,不耗额度)立刻告诉你能省多少——预估省得多说明是图片问题,几乎省不了说明文件本来就很紧凑。
操作步骤
- 1
先用压缩工具做诊断
拖入 PDF(本地处理,不上传),处理前预估会显示能省多少。
- 2
能省很多?直接压缩
说明是图片问题。标准档保持阅读画质;有硬性大小要求用指定大小模式。
- 3
几乎压不动?文件本来就紧凑
工具会如实告知压缩没有收益,且不扣额度。
- 4
担心隐私?顺手清除元数据
用「PDF 元数据编辑」查看并清除文档元数据(含 XMP)。
常见问题
纯文字的 PDF 为什么有 8MB?
多半是内嵌了整套字体(尤其中文字体)或残留了未引用对象。压缩会重建文件并丢弃没用到的部分。
删掉一半页面,体积为什么没减半?
共享资源(字体、图片)可能整个文件只存一份。删页后再压缩一次才能真正回收空间。
免费吗?会上传吗?
Beta 期免费,每日额度页面明示。压缩和预估都在浏览器本地完成,不上传,可在开发者工具里自行验证。