如何把照片变成可搜索的PDF

  1. 添加你的图片. 把JPG、PNG或WebP格式的照片拖进工具,或点击选择文件。每一页都会显示为一张卡片——拖动手柄可以调整顺序,也可以删除不需要的页面。
  2. 选择语言. 选择文档所使用的语言。该语言的识别数据只需下载一次(选择器旁会显示大小)——你的图片依然不会离开你的设备。
  3. 开始识别. 点击“识别文字”,每张卡片会从等待状态逐步变为完成状态,并实时显示字数。识别过程中可以随时取消,不会保留任何内容。
  4. 检查并下载. 识别出的文字会按页显示,方便你在信任结果之前先核对一遍。给输出文件命名,然后下载可搜索的PDF,或获取纯文本.txt文件,也可以把所有文字复制到剪贴板。

它能做什么

  • 在浏览器里完成真正的文字识别——文件绝不会被上传到任何地方
  • 多张照片合成一份多页PDF,页面顺序由你决定
  • 隐形文字层:PDF看起来和你的照片一模一样,却可以搜索和复制
  • 支持15种识别语言,按需下载
  • 还能把纯文字结果导出为.txt文件

可搜索的PDF到底是什么

一张收据的照片只是一堆像素——你无法搜索它,无法选中总金额,也无法复制商家名称。可搜索的PDF会在图片上叠加一层隐形的文字层:识别出的文字,位置对应它们在图片中出现的地方。页面看起来还是和你的照片一模一样,但预览、Adobe Reader、Spotlight以及各种文档系统现在都能读懂它了。

这个工具就在你的浏览器里生成这样的文件。它解码你的图片,运行编译为WebAssembly的开源Tesseract识别引擎,再用pdf-lib拼装出一份PDF——全部都在你正在看的这个页面里完成。没有任何内容被传输出去。这正是它存在的意义:收据、合同、医疗信件和身份证件,恰恰是那些你不该为了免费OCR而交给某个陌生转换网站的文件。

什么时候用它

  • 希望以后能搜索到的纸质文档照片——收据、保修单、信件、表格。
  • 扫描仪生成的普通图片扫描件。
  • 任何你不愿意粘贴到陌生网站上的内容。

为什么文字层的位置很重要

识别出的文字不是简单地附加在文件末尾——每一个词都被隐形放置在它在照片中出现的坐标上。这正是选中效果自然的原因:在图片上拖动选区,高亮就会跟随印刷的行走;搜索一个词,查看器就会跳转到页面上正确的位置。这种定位是近似的,就像办公室扫描仪生成的文件一样,但对于查找和复制来说完全够用。

如实说明的局限

本地OCR比服务器集群慢,而且它读的是印刷体,不是手写体。非常小或模糊的文字可能识别出错——.txt导出功能方便你逐一检查。为了识别速度,图片会被缩小到长边约2500像素;而嵌入的页面图像最多保留4000像素,以letter纸张尺寸打印依然清晰。

如果你经常需要这么做

这个工具是一次性的转换器。如果你的相册就是文档消失的地方,Paperlock正是为解决这个问题而存在的:它在你的iPhone上扫描、识别并归档你的各种文件——同样遵循“未加密内容绝不离开你的设备”这条原则。