合并扫描文档
合并扫描件和合并其他PDF是同一个操作,多一个尾巴问题:结果很大。文档先一次合并好,成品再压一次。这个顺序让图片只重编码一轮,而不是一遍遍来。
先合并,后压缩
打开合并工具,所有扫描文档加上,排好序,合并。结果拿去压缩工具,报上要的大小。
反过来白亏质量,半点好处没有。先压分件再合并,等于每页先过一遍图片编码,再把编好的图片拷进新文档,最后猜几个加起来没定量的分目标。成品压一遍,直接瞄你要的数字。
合并文件为什么这么大
扫描件是页面的照片。分辨率不高,一页照片的数据也比同一页真文字多得多;进纸器设成彩色,再翻几倍。十个扫描文档,一个二十页,轻松几百MB。
合并既不加也不减。页面原样拷,合并文件和各部分之和差不多。
扫描件能压到多小
扫描件是压缩最好啃的。拍的页面有真文字没有的余量,像素能重编码变小,字不变,所以同样体积,扫描件通常比原生文档落得更低。
引擎按字节目标干活,不按质量滑块。你报大小,几个方法跑,结果读回来检查过再交。这里不承诺成功数字:没够着也报实际到达;满页油墨的照片页,可能还在你的数字上面。
合并留什么,清什么
每页内容、宽、高都留,A4和Letter混在一起还是混在一起。合并文件重新打开,和源文件记的收据逐页比对,交货前先过;对不上,合并被拒绝而不是下载。
文档属性清空,合并PDF不带任何扫描件的标题、作者和日期。书签、表单、页码、附件一样过不来,跑之前工具点名谁带了。
做过文字识别的扫描件,文字层留下来,因为文字是页面的一部分。识别准不准是识别的事,合并既不提高也不破坏。
排名靠前的页面都讲什么
这个问题的排名页先教拍,再教合。WikiHow那页扫描仪、iPhone、Android拍法走完才到合并;小工具们(AskPDF、PDFree、FileSplice)把合并本身当上传卖。那些是它们自己页面上的说法,不是这里测出来的。
本指南从它们停的地方开始:扫描件已经在手里,问题是顺序。先合并后压缩,成品压一遍直接瞄你要的数字;先压分件等于猜几个加起来没定量的分目标。合并清掉属性、书签、字段、页码,跑之前先说;压缩没够着也报实际到达。
合并前
确认每个部分是你以为的那个文档。扫描仪输出的scan0042什么都说明不了,合完发现文件错了,整个活重干。
跨扫描件排对顺序
扫描文件不带归属线索。一文件夹scan0031到scan0074是纸过进纸器的顺序;卡过纸、背面第二遍扫、某份重扫,都不是页序。
合并前每个文件的第一页打开,真实顺序记下来。工具里拖出来,每文件旁边的页数和预期对一遍。以为一页的东西装了十二页,合并前抓出来比合并后划算。
大家常问的问题
- 页面先收拾还是先合并?
- 先删先转,再合并。小文件里修一张横的、一张白的,比长合并文档里捞快。
- 扫描文件先压还是合并完压?
- 合并完压。全部合成一个文档,对照真正要的大小压一次。先压分件,图片编码两遍,最终大小靠猜。
- 合并会让扫描页变难看吗?
- 不会。页面不重渲染原样拷,合并扫描件和源文件长得一样。之后压缩才动质量,动多少看你的大小目标。
- 合并扫描件能小多少?
- 这里不承诺数字。照片页有文字没有的余量,扫描件通常比原生文档压得更小;但你的文件看自己的内容,没够着目标,工具报实际到达。
- 识别出的文字层还在吗?
- 在。识别文字是页面内容的一部分,跟着页面拷,保持可选、可搜。准不准是识别的事。
现在就做
工具就在这个浏览器里跑。你的文件不出本机,结果下载前经过检查。
合并PDF接下来去哪里
- 合并PDF 按你定的顺序把几个PDF合成一个文件。
- 压缩PDF 把PDF变小,不把文字变成图片。
- 手机扫描多页合成一个PDF 多页扫描件进一个PDF。
- 合并PDF 找到把文件合成一个PDF的合适指南。