经验分享
拆分、压缩、合并:多合一的PDF组合工作流
单点操作学会之后,真正提效的是把它们串成流水线。这篇分享我处理"一堆散页/一份大文件"时最常用的三个组合拳:先拆再压、压完合并、边拆边合。场景不同,顺序大不同。

场景一:大文件只需要其中几页
一份180MB的投标文件,领导说"只要第8-15页的技术方案"。全量压缩再发?没必要。正确姿势:先拆分,再压缩。
Acrobat:「组织页面→提取页面8-15」,提取出来的小文件再走优化PDF,几十MB直接变几MB。免费路线:iLovePDF的「拆分PDF」按页码提取,再用WPS压缩。这样你只处理了需要的部分,速度和体积都最优。
场景二:一堆散件要合成一个合集
月底20张报销凭证、12张电子回单,逐个发是灾难。正确姿势:先逐个压缩(顺手统一规格),再合并。
顺序有讲究:先压后合。因为合并后再压,是"一锅烩"——所有页面一个参数;而先压后合可以对不同来源用不同参数(发票转灰度、带章的保彩色),合并后的合集既小又精准。合并工具随手可得:WPS「PDF合并」、iLovePDF、Acrobat「合并文件」,甚至iPhone快捷指令都有「合并PDF」动作。
合并时记得顺手排序和命名——合集的可读性一半靠顺序。
场景三:既要瘦身又要重新组织
老档案重构:500页的扫描合集,要拆成按年份的多个文件,每个还要压小。这是「拆分→分组压缩→分别合并」的三段式:
1. 按目录页码拆分成年份段;
2. 每段跑同一套压缩参数(保证规格统一);
3. 段内多卷合并或保持散卷,按「2020年_卷一.pdf」命名归档。
这套流程用Acrobat的「动作向导」能录制成一键动作;用Python的话就是pikepdf拆分+Ghostscript压缩+pikepdf合并,50行代码搞定500页。
组合拳的三条军规
一是任何拆分合并前保留原始文件——拆装操作偶有书签丢失、页序错乱,留条退路;二是批量操作前先拿一小段试跑,确认页序和画质符合预期再全量执行;三是命名规则先行:拆出来的文件先定好命名模板(前缀+页码段+日期),避免中途改主意导致返工。
单点工具是零件,工作流才是机器。把拆、压、合按场景串起来,处理文件的效率是质变的。