没人会为了一份无关紧要的文件去抽页。人们抽页,是因为整份材料里只想发出去两张纸:一份只有首页有用的对账单,一份只留附件的合同,一本只想单独拿出一行的病历。换句话说,那几乎总是一份谁也不想交出去的文件。
这件工具用同一套机制做三个动作:只保留您点名的页、删掉您点名的页,或者把文件切成页数那么多个文件。三种情况下,页面都是被原样复制的:一样的字体、一样的图片、一样的尺寸,字节对字节。
这类工具唯一会出错的地方,是读懂您写的页码区间。“1-3, 7, 12-”不是什么标准写法,每个人写法都不同。这件工具认逗号、分号、空格、各种各样的横杠,也认开口的区间,然后它会在动手之前把选中的页码列出来。您要的某一页如果不存在,会在屏幕上被点名,绝不会被悄悄跳过。
怎么用
- 把您的 PDF 拖进来。页数马上就会显示出来。
- 选好动作:保留点名的页、删掉它们,或者把每一页拆成单独的文件。然后输入页码区间。输入框下面那句话会告诉您到底会取走什么。
- 点一下。文件就来了。在“每页单独一个文件”模式下,有多少页就来多少个文件,您的浏览器可能会为“多文件下载”弹一个授权请求。
支持的格式
只收 PDF。页码区间数的是文件里的页,不是印在页面上的页码:如果您的文件前面有两页封面,页脚上写着“1”的那一页在文件里是第 3 页。
PDF 文件
选中的页面被复制过去,既不重新绘制也不重新压缩。得到的文件大小差不多就是原文件里对应的那一份。
它的限制
页码指的是文件里第几页,不是印在纸面上的号码
一份文件常常有封面、目录,有时还有空白页:页脚上印着“1”的那一页于是排在文件的第三位。任何工具想读出印刷体的号码,都得靠文字识别,而我们不内嵌那种东西。所以这件工具数的是页,而且它把这一点说出来。
在“每页单独一个文件”模式下,浏览器可能会要一次授权
一次点击下载多个文件,是浏览器给的许可,不是天生的权利:Chrome 会为“多文件下载”问您一次。我们不绕开任何东西,两次下载之间隔三分之一秒,而且您随时可以分两次来拆。
80 MB
文件会被完整地打开在内存里,产出的每一块还要在旁边占一份。这是一个普通设备上、一个标签页的老实上限。
带密码保护的 PDF 在这里打不开
得先把它解开,而这需要它的密码。同一个专区里的“给 PDF 加密码”工具会做这件事。
得到的文件不继承原件的身份信息
三页的摘录不是它出身的那份文件:把原件的标题和作者留给它,会让它冒充原件。所以身份信息是空的。而附在某一页上的元数据会跟着那一页走,因为那一页是被原样复制的:同一个专区里的“清除 PDF 的元数据”工具能把它们显示出来并清掉。
关于这个工具的问题
我的文件会被发到什么地方吗?
不会,而且三十秒就能自己验证。按 F12 打开开发者工具,切到“网络”标签页,清空列表,然后把文件拖进来切一次。一行都不会冒出来。把网断掉再做一次:工具表现完全一样。
页码区间该怎么写?
怎么顺手怎么写。“4”取第 4 页。“1-3”取第 1 到 3 页。“1-3, 7, 12-”取第 1 到 3 页、第 7 页,再从第 12 页一直取到最后。分号和逗号一样管用,空格会被忽略,键盘或者文字处理软件自动替换出来的长横杠也认得。输入框下面那句话会在您点击之前,告诉您将要取走什么。
我输入的号码,是印在页面上的那个吗?
不是,是它在文件里的位置。如果您的文件有封面和目录,页脚标着“1”的那一页在文件里排第三。要读印刷体的号码就得用文字识别,那是一个十兆开外的引擎,我们不内嵌。所以请数页,或者把文件在旁边打开来对位置。
页面顺序会保留吗?
会,而且是按您点名的顺序。“7, 1-3”得到的文件,开头就是原来的第 7 页。重复的页只取一次。如果您想在不删页的前提下重排或旋转页面,同一个专区里的“重排和旋转页面”正是为这件事做的。
画质会下降吗?
不会。什么都不会被重新绘制或重新压缩:页面连同字体、图片和尺寸一起被复制过去。得到的文件大小差不多就是原件里对应的那一份,而这正说明什么都没被动过。
为什么在“每页一个文件”模式下浏览器要我授权?
因为一次点击下载多个文件是一项许可,不是天生的权利:浏览器想确认这是您本意。我们不绕开这个请求,并且把每次下载隔开三分之一秒,免得有哪个丢掉。碰上一百页的文件,还是分两次来拆更稳妥。