把页面照片变成扫描件
文件照片往往发灰、一侧偏亮,还歪了一点。本工具会把它摆正、均衡光线让纸张呈现白色,并保存为PDF——还可以选择在背后加上文字,让扫描件可以搜索。
- 绝不存储
- 无需排队,无需等待
- 无需注册,无水印
使用方法
添加照片
一页或多页均可——它们会按您添加的顺序成为同一个PDF的各个页面。
查看清理效果
系统会测量并去除倾斜,估算字迹背后的纸张底色并将其提亮为白色——正是这一步让照片不再像照片。
下载PDF
如果选择添加文字层,文字会被识别并以不可见的方式覆盖在页面上,这样扫描件就可以搜索和复制。
把照片变成看起来像文档的东西
页面照片和页面扫描件有三处不同,这里修正了其中两处。页面会被摆正——扫描时进纸歪了、或拍照时略有旋转的页面会被转平——并且会被转为正向,横着拍的页面输出时方向是正的。这两步本来就是识别所必需的,所以顺带就完成了。对比度也会提高,让纸张呈现为白色、字迹呈现为黑色,而不是一张灰蒙蒙的文件照片。
第三处不同没有修正,这正是需要事先考虑的。透视不会被校正:斜着拍摄的页面会保持梯形,远端更窄,只有旋转会被摆正。有明显折痕、或向厚书书脊弯曲的页面,仍然是弯的。这两种情况既让文字更难识别,也更难看——所以您能做的最有用的一件事,就是把相机举在页面正上方,而不是俯身斜着拍。
选择添加文字层后,您会得到一个看起来和照片完全一样、用起来却像文档的PDF:识别出的文字以不可见的方式覆盖在图片中对应的文字上,所以文件可以搜索、选中和复制,同时仍是原件的图像。内容不会被重新排版,外观也不会改变——对于收据、合同或任何原件外观本身就是记录一部分的文件,这正是您需要的。
准确率取决于拍摄质量,而且差别一点也不小。平整、光线均匀、对焦清晰且正对相机的页面识别效果好;您自己的头在页面上投下的阴影、手机闪光灯在光面纸上的反光、或者皱巴巴的收据,识别效果就差。中文、日文和韩文的词能被识别,但只会计数而不会写入文字层,因为没有内置能承载它们的字体——页面会告诉您有多少个,而不是留下您可能注意不到的空白。
如果您需要的是别的
您的手机几乎肯定内置了这个功能,而且做得更好。iOS上的备忘录应用和Android上的Google云端硬盘(Google Drive)都能扫描文档,并实时校正透视——在您举着相机时找到页面边缘,把梯形正确地拉平,这恰恰是这里缺少的一步。如果是拍摄页面,请用它们之一,需要进一步处理时再把结果拿到别处。
如果是一大叠页面,OCRmyPDF才是合适的工具,而且免费:ocrmypdf --deskew --rotate-pages --clean in.pdf out.pdf一次就能对任意长度的文档完成摆正、旋转、清理和添加文字层,加上--output-type pdfa还能同时生成归档格式。unpaper能处理更棘手的扫描清理——去除书籍扫描件的黑边、拆分双页跨页——这些是这里完全没有尝试的。
常见问题
它具体改变了什么?
三件事。倾斜:在整页范围内测量文字的角度并去除,让每行文字保持水平。光线:分块估算字迹背后纸张的亮度,并提亮为均匀的白色,去掉一侧边缘的暗角和手的阴影。对比度:让字迹在白底上显得更深。它不会凭空捏造任何东西——不会“锐化”出原本没有的细节。
能让扫描件可以搜索吗?
可以。开启文字层后,每个词都会被识别,并以不可见的方式放在图片中对应的位置,这样按Ctrl+F就能找到,也可以在PDF中选中和复制。页面看起来和照片完全一样;文字不会被画出来,只是变得可以选中。
我的照片会被存储吗?
不会。清理和识别都在这里完成,不存储任何文件,也不会发送到任何地方。
需要先裁剪到只剩页面吗?
这样会有帮助。纸张底色的估算在画面大部分是纸张时效果最好,所以周围有深色桌面的照片,先裁剪一下效果会更好。倾斜测量会有意忽略外侧边缘,所以留一点背景没有问题。
斜着拍的照片能修正吗?
它能去除旋转——歪了几度的页面会被摆正。但它不校正透视,所以从侧面拍摄、一边长一边短的页面会保持原来的形状。多花一秒从正上方拍摄是值得的。
彩色还是黑白?
保留彩色,只把背后的纸张变白——所以印章、蓝色墨水的签名或荧光笔标记都保持原来的颜色。这通常正是您想要的文档效果;它不是一份黑白传真。
生成的PDF有多大?
每页都以适合阅读的尺寸存储为JPEG,而不是相机的全分辨率,所以一张4 MB的手机照片通常每页不到1 MB,100%查看时看不出损失。
小贴士: 不校正透视:斜着拍摄的页面会保持梯形,只修正旋转。有明显折痕或靠近书脊处明显弯曲的页面仍会弯曲。如果您选择添加文字层,它和任何OCR一样有局限——而且中文、日文和韩文的词只会被计数而不会写入,因为没有内置能显示它们的字体。
把这个工具放到您的网站上
博客、课程页面或帮助文章均可免费使用。粘贴一段代码,访客就能直接在您的页面上使用。