这个压缩工具会对你的文件同时尝试两种完全不同的策略,然后把胜出的那个给你。第一种是无损的结构重存:pdf-lib 重新打开文档,启用对象流重写一遍,去除内部对象的重复并把文件结构打包得更紧凑。全程没有光栅化,因此文字仍可选中、链接仍可点击、矢量图形依旧锐利。
第二种是光栅化:把每一页按缩小的倍率渲染到画布并重新编码为 JPEG,再重建成新的 PDF。这会毁掉可选文字,但对扫描件效果惊人——扫描件本来就只是装在 PDF 容器里的图片。
两个结果按体积比较,较小的那个就是你下载到的文件。如果两者都没能小过原文件,工具会告诉你文档已经是最小状态,并把未经改动的原件还给你,而不是一个更差的版本。
两条压缩路径都在浏览器内执行。合同或护照扫描件在你自己的设备上处理,不会有副本落进某个压缩服务的服务器队列里。
| 等级 | 渲染倍率 | JPEG 质量 | 适用场景 |
|---|---|---|---|
| 基本 | 1.5 倍 | 0.72 | 仍需仔细阅读的文档 |
| 中等 | 1.15 倍 | 0.58 | 常规选择:邮件附件、上传 |
| 强 | 0.85 倍 | 0.42 | 体积限制很紧、能看清即可 |
这些数值只作用于光栅化路径。无损重存没有可交换的画质,因此完全忽略等级设置。这也是为什么以文字为主的报告在「基本」和「强」下缩减幅度相近。
以文字为主的 PDF 本身已经极其紧凑:词句以字体引用和坐标存储,每个字符只占几个字节,几乎没有可挤压的冗余。把这样的页面光栅化反而会变大,因为一页铅字变成了一张拍下铅字的大照片。工具会识别这种情况并退回无损重存,所以你的文字文档可能只减少百分之五。
扫描文档正好相反:每一页都是完整分辨率的照片,往往以 300 DPI 采集并用宽裕的画质设置保存。以更低的倍率和质量光栅化,常常能在不损害可读性的前提下减少百分之七十到九十。
取决于哪条路径胜出。如果无损重存生成了更小的文件(以文字为主的文档通常如此),文字、链接和矢量图形都会完整保留。如果像扫描件那样由光栅化胜出,页面就变成图片,文字无法再选中。
基于文字的 PDF 本就高度压缩,可去除的冗余很少。大幅缩减来自包含照片或扫描页的文档。如果完全无法节省,工具会返回未经改动的原文件而不是降质的副本。
绝大多数情况选「中等」。文档仍需仔细阅读或需要打印时选「基本」;只有在上传体积卡得很死、能看清就行时才用「强」。
可以,但请注意多个文件不会分别返回,而是合并成一个压缩后的 PDF。要逐个压缩,请一次处理一个。
设了密码的 PDF 根本无法打开,会报错。电子签名因为文件被重写而不会保留,已签署的文档最好保持原样。
不会。PDF.js 和 pdf-lib 都以 JavaScript 形式在本页内运行,全过程都在浏览器里完成,文档不会离开你的设备。