← 全部实测指南

办公实测指南 · 本站原创样例

PDF 压缩后反而变大:用同一份扫描文件复现实测

质量参数不等于压缩率。用已经压缩过的扫描页再次编码,观察体积为什么增加,以及什么时候应该保留原文件。

维护:办公工具大全 · 内容更新: · 样例日期与方法见文末

打开 PDF 压缩

同一输入,两次独立处理

输入:256435 字节。下面是实际输出,不是估算值。

质量参数输出字节数相对输入
70330527 B增大 28.9%
95587963 B增大 129.3%

结论:这两次处理没有达到减小体积的目的。保留输入文件,避免用更大的输出替换它。

先说明这次实测的边界

输入为本站制作的合成扫描页 scan-q40.pdf,只有一页 A4,已经过一次质量 40 的 JPEG 重编码。它不是原始扫描母版,也没有真实业务内容。本次专门检验“对已压缩文件再提高质量”的结果。

两次操作都重新使用同一个输入:第一次质量 70,第二次质量 95,下载格式都选 PDF。不要把质量 70 的输出当作第二次输入,否则测试条件不同。

复现结果并核对页数

输入为 256435 字节。质量 70 输出 330527 字节,增大 28.9%;质量 95 输出 587963 字节,增大 129.3%。页数仍为一页,A4 页面尺寸没有变化。

下载三份文件,在文件属性中核对实际字节数,再用阅读器比较同一段小字与细线。阅读器显示大小可能经过四舍五入,下表使用的是文件真实字节数。

结果取决于原文件、编码器及版本,本表不代表所有 PDF 的规律,也不是压缩率承诺。体积增加本身不能证明画质提升。

为什么提高质量不能找回细节

当前工具会重写 PDF 内容流,并尝试把可处理的嵌入图片按所选质量重新编码。已经采用较低质量保存的 JPEG,再按较高质量编码,可能为现有像素使用更多字节。

第一次有损编码时丢失的细节不会因为后来把参数调高而自动回来。若要改善清晰度,应回到原始扫描件重新处理,而不是反复转码当前输出。

PDF 还可能包含文字、矢量图形、字体和其他对象。体积变化不能全部归因于图片质量;图片很少的文档不适合照搬扫描页的参数。

根据目标选择下一步

原文件已经小于接收方上限且清晰时,直接使用原文件。输出更大时保留原件,不必为了“压缩成功”而替换成新文件。

仍然超限时,先用 PDF 体检确认页面结构,再从原件尝试较低质量,每次检查小字。若无法兼顾大小和清晰度,可在接收方允许时删除无关页或按章节拆分;拆分不是所有上传平台都接受的办法。

涉及签名、表单、书签或批注的文档,体积和视觉对照仍不足以验证全部功能。处理前保留原件,交付前检查这些原有特性。

下载输入与实际输出

所有文件均为本站制作的合成样例,不含真实业务信息,可下载并复现操作。

2026-10-08,调用本站 /api/pdf/compress 接口;两次使用同一输入,输出 PDF。环境:pypdf 6.19.0 / PyMuPDF 1.28.2 / Pillow 12.3.0。复现脚本和字节记录随网站项目保存。

文件实际字节数下载
输入:已经压缩过的扫描页256435 B下载文件
质量 70 的实际输出330527 B下载文件
质量 95 的实际输出587963 B下载文件