如何在浏览器里扫描文档

  1. 拍下文档照片. 点击“拍照”使用相机,或直接放入一张你已有的照片。选一个平整的表面、良好的光线,并站在不会让阴影落在纸面上的位置。
  2. 调整四角. 工具会自动给出文档边缘的位置建议。拖动任意一个角来修正——会出现一个放大镜,方便你精确对准纸张的边缘。
  3. 选择一个滤镜. 文档模式会让纸张变白、文字变深,效果就像真正的扫描仪一样。需要的话也可以选择灰度或原图模式。
  4. 添加页面并下载. 每一张纸都点一次“添加页面”,需要的话调整顺序,再把所有内容下载成一份PDF。

它能做什么

  • 自动边缘检测(直线追踪加背景建模双管齐下),配有可拖动的四角裁剪框和放大镜辅助微调
  • 正确处理旋转过的手机照片——会读取并应用EXIF方向信息,连老版本的Safari也支持
  • 文档滤镜能让纸张变白、文字变清晰——另有灰度和原图两种模式
  • 支持多页:不断添加页面,调整顺序,再下载成一份PDF
  • 可以用你iPhone的相机拍摄,也可以直接使用手头已有的照片
  • 完全在你的浏览器里运行——照片从不会被发送到服务器

一个把处理留在原地的扫描工具:留在你的设备上

大多数“免费在线扫描”网站的工作方式都一样:你把文档照片上传到它们的服务器,由服务器处理,再由你下载结果。对于一份租约、一本护照或一张医疗账单来说,这是一笔奇怪的交易。这个扫描工具做的是同样的事——透视校正、画面清理、组装PDF——但全部由运行在你自己浏览器里的JavaScript完成。你拍下的这份文档,从不会离开拍摄它的那台设备。

它实际上是怎么运作的

当你选定一张照片,工具会用两种方式同时寻找文档的轮廓:一是追踪图像中最明显的直线边缘(扫描类App通常也是这么做的),二是单独根据照片边缘对背景建模,找出不属于桌面的那块区域。当两种方法结果一致时,裁剪建议通常只有几个像素的误差;当照片比较棘手时——背景杂乱,或文档占满了整个画面——工具会明确提示,并给你一个合理的初始位置作为起点。接下来你可以手动修正四个角——放大镜会跟随你的手指移动,方便你把每个角精确对准纸张的真实边缘。基于这四个角,工具会计算出一个透视变换(和真正的扫描App使用的数学方法相同),把页面重新投影成一个规整的矩形。“文档”滤镜会把每个像素和它周围的局部区域做比较,所以即便整张纸的光线不均匀,纸张依然会变白,文字依然保持深色。最后,这些页面会被嵌入一份PDF,整个过程都用一个开源库在浏览器里完成。

怎样才能扫出“真正像扫描件”的效果

透视变换能修正角度,但无法凭空补出照片里本来就没有的细节。有三个习惯能带来明显差别:用窗户的自然光而不是头顶的灯光(阴影更少),把手机平放在纸面正上方而不是倾斜着拿(需要校正的畸变更少),以及在纸张下面垫一个对比明显的表面(白纸放在白色桌面上,边缘检测器几乎找不到任何线索——你自己也要多拖动几次四角才能补救)。

这个工具不做什么

它不会读取文字内容。你下载到的PDF是一叠图片——非常适合打印、发邮件或归档,但你无法在里面搜索内容,手机也搜不了。它也不负责整理任何东西:你租约的第3页会原封不动地待在“下载”文件夹里你放它的地方。如果你更希望只扫描一次,之后就能靠提问找到东西——比如“押金交了多少?”——那正是带OCR的文档保险库要解决的问题,也正是Paperlock被造出来的原因。