压缩 PDF 的工作原理
PDF 压缩工具通过无损结构优化来缩小 PDF 文件大小:重建交叉引用表、合并重复对象、删除历次保存留下的过时更新节,并将内容打包到压缩对象流中。所有操作在浏览器内的 pdf-lib 中运行,你的 PDF 不会发送到任何服务器或云服务。
共有两种模式,二者的区别很重要。默认模式就是这种无损处理:它不会对嵌入图像进行降采样、重新编码或剥离,因此得到的文档与你放入的完全一致,只是打包得更紧凑。强模式则是相反的取舍:每一页都会按你选择的 DPI 重新渲染为 JPEG 图像,这能大幅缩小扫描版 PDF,但生成的是纯图像文件。文字不再可选中、不可搜索,链接和表单字段也不会保留。只有在文件大小压倒一切的文档上,才应有意识地选择它。如果你的 PDF 体积大主要是因为包含高分辨率照片,仅靠结构清理获得的节省幅度会很有限。最大收益来自以下情形:PDF 经过多次保存并积累了增量更新、包含重复资源对象、或有未压缩的交叉引用节。对于以图像为主且文件大小要求严格的 PDF,在嵌入前先对图像进行压缩才是更有效的方法。