为什么合并后的 PDF 反而变大
很多人以为把多个 PDF 合并成一个,体积就是简单相加。实际合并后往往会比原文件总和更大,原因有三:一是各 PDF 内嵌的字体被重复保留;二是元数据和交叉引用表增加;三是部分合并工具会重新封装对象,产生冗余。如果原始文件里有高清扫描图,合并后体积膨胀会更明显。
合并只是第一步,真正要方便邮件发送、微信传输、网站上传,往往还需要再做一次压缩。
合并后压缩的正确顺序
推荐顺序是:先合并,再压缩。如果你先压缩再合并,合并工具可能解封压缩流再重新封装,导致之前的压缩效果丢失。
压缩的几个关键维度
图片降采样
PDF 体积大头通常是图片。扫描件常见 300 DPI 甚至更高,屏幕阅读其实 150 DPI 就够。压缩工具会把图片重采样到目标分辨率,体积能降一半以上。注意:如果要拿去打印,别降太多,建议保留 200 DPI 以上。
图片重新编码
把未压缩或 BMP 编码的图片转成 JPEG(照片)或 PNG(含透明度/线条图),效果立竿见影。文字扫描件用黑白 CCITT G4 编码最小。
字体子集化
只嵌入文档实际用到的字形,而不是整套字体。中文 PDF 尤其受益——一套宋体可能十几兆,子集化后只保留出现的几百字。
清理冗余对象
合并过程可能留下未引用的对象、重复的 XObject、废弃的元数据。压缩时做一次 clean,能再省 5%~15%。
不同场景的压缩策略
| 场景 | 建议策略 | 预期体积 |
|---|---|---|
| 邮件附件(25MB 限制) | 中度压缩,图片 150 DPI | 原始 30%~50% |
| 微信发送(100MB) | 轻度压缩,保留 200 DPI | 原始 50%~70% |
| 网站下载 | 较强压缩,图片 120 DPI | 原始 20%~40% |
| 归档存档 | 轻度压缩,优先清晰度 | 原始 60%~80% |
常见误区
一味追求最小体积
压得太狠文字会发糊、图片出马赛克,尤其含印章、签名的合同,过度压缩可能导致法律效力争议。先小范围试一份,确认清晰度再批量处理。
忽略压缩是"有损"过程
每次重新压缩都可能损失质量。建议保留原始合并文件,压缩版单独命名,方便后续重新生成。
实操建议
DocsAll 的合并和压缩都在浏览器本地完成,文件不上传,适合处理合同、报表这类敏感文档。流程上记住"先合并后压缩",并按用途选择不同压缩档位,不要所有文件都用最强档。
合并后体积仍然偏大时,先用压缩工具看体积构成——如果是图片占大头就降采样,如果是字体就子集化,对症下药比无脑强压更有效。