提取PDF页面
点选页面或输入页码范围,挑出您需要的页面,合成一个新的PDF,或者每页一个文件。私密处理,绝不存储。
- 绝不存储
- 无需排队,无需等待
- 无需注册,无水印
使用方法
添加PDF
把PDF拖放到页面上。每一页的预览会立即出现。
选择页面
点选您需要的页面,或在输入框中输入1-3, 9这样的范围。“全选”和“清空”一点即可。
选择输出方式
把所选页面合成一个PDF,或者打包成ZIP、每页一个文件——然后下载。
提取出的页面会带上什么
“全新干净文档”这句话中,值得认真对待的是全新二字。您的页面被复制到一个从零创建的文档中,因此页面内容完全一致——不重新压缩、不缩放,字体和图片都相同——但原文档的文档级附属结构根本不存在,也就无从继承。没有书签大纲、没有页码标签、没有附件、没有标题或作者,也没有表单。最后这一点有一个看得见的后果,在发送文件前最好知道:已填写字段的控件是画在页面上的,会随页面一起带过来,所以填写的答案依然可见;但告诉阅读器这些控件是表单的那部分字典信息没有带过来。提取出的表单页面看起来完整,却再也无法填写了。
页码标签最容易让人困惑。一份报告的前言部分编号为i、ii、iii,这些标签存储在文档中,而不在页面上,所以提取前言的第三页后,得到的单页PDF在每个阅读器中都显示为第1页——而页面上印着的数字仍然是iii。文件本身没有问题,只是两套不同的编号系统不再一致了。
“每页一个单独的PDF”会让页面之间共享的所有内容成倍增加,因为每个文件都必须是独立完整的。源文件中只嵌入一次的字体子集,会在每一个用到其中字符的文件里重新嵌入一次;四十页上都有的信头会被存储四十次。单页文件打包成的ZIP,总大小通常会超过原文档;而且对于长文档,ZIP完全在内存中生成,这一点最有可能让手机在这里吃不消。
如果您需要的是别的
在这里,页面始终按文档原有顺序输出。如果顺序才是关键——把附录挪到最前面,或者交错合并两份扫描件——qpdf in.pdf --pages . 9 . 1-3 . 12-14 -- out.pdf会按照您写的任意顺序读取页码范围,同一页写几次就重复几次;而且因为输入文件仍是主文档,它会保留书签大纲和文档信息,这是这里的提取做不到的。
如果要从非常大的文件中提取一个范围——上千页的扫描件,或者浏览器标签页装不下的文件——qpdf和Poppler的pdfseparate -f 5 -l 12 in.pdf page-%d.pdf都是直接从磁盘流式读取,而不是先把整个文档载入内存,而且两者都没有任何大小上限。
常见问题
提取和拆分有什么区别?
提取只保留您选中的页面,其余的丢弃。拆分则是把一个文档分成多个。两者这里都能做:选择“每页一个单独的PDF”,提取的效果就和拆分完全一样。
可以直接输入页码,而不是逐个点选吗?
可以。范围输入框同时支持单个页码和范围——“1-3, 9, 12-14”——在长文档中比逐个点选快得多。网格会随之更新,准确显示您选中的页面。
提取出来的页面质量会保持吗?
会。页面按原样复制——不重新压缩,不缩放,无水印。
我的PDF会被存储在任何地方吗?
不会。整个过程中不存储任何内容。文件绝不会被存储。
提取出的页面会按我点选的顺序排列吗?
它们会按文档中的原有顺序输出,这几乎总是大家想要的。如需自定义顺序,请先提取,再使用“PDF页面排序”。
小贴士: 与未选页面相关联的书签、链接和表单字段不会被带过来——提取出的文件是一个只包含您所选页面的全新干净文档。
把这个工具放到您的网站上
博客、课程页面或帮助文章均可免费使用。粘贴一段代码,访客就能直接在您的页面上使用。