Как превратить фото в PDF с поиском по тексту
- Добавьте изображения. Перетащите фотографии в форматах JPG, PNG или WebP в инструмент или нажмите, чтобы выбрать их. Каждая страница появляется отдельной карточкой — перетаскивайте за маркер, чтобы изменить порядок, или удаляйте ненужные.
- Выберите язык. Укажите язык, на котором написаны документы. Данные для распознавания этого языка загружаются один раз (размер указан рядом с выбором) — ваши изображения при этом по-прежнему никуда не отправляются.
- Распознайте текст. Нажмите «Распознать текст» и наблюдайте, как карточка каждой страницы проходит путь от ожидания до готовности, с живым счётчиком слов. Процесс можно отменить в любой момент — ничего не сохранится.
- Проверьте и скачайте. Распознанный текст показан по страницам, так что вы можете проверить его перед тем, как доверять результату. Задайте имя файла, затем скачайте PDF с поиском, простой текст .txt или скопируйте всё в буфер обмена.
Что он делает
- Настоящее OCR прямо в браузере — файлы никуда не загружаются
- Несколько фотографий становятся одним многостраничным PDF в выбранном вами порядке
- Невидимый текстовый слой: PDF выглядит как ваше фото, но по нему можно искать и копировать текст
- 15 языков распознавания, загружаются по мере необходимости
- Также экспортирует распознанный текст отдельным файлом .txt
Что такое PDF с поиском по тексту на самом деле
Фото чека — это просто набор пикселей: в нём нельзя искать, нельзя выделить сумму или скопировать название магазина. PDF с поиском добавляет поверх изображения второй, невидимый слой: распознанный текст, расположенный там же, где он находится на картинке. Страница по-прежнему выглядит точь-в-точь как ваше фото, но теперь её может прочитать Preview, Adobe Reader, Spotlight и любая система работы с документами.
Этот инструмент собирает такой файл прямо в вашем браузере. Он декодирует изображения, запускает движок распознавания Tesseract с открытым кодом, скомпилированный в WebAssembly, и собирает PDF с помощью pdf-lib — всё на той же странице, которую вы сейчас видите. Ничего не передаётся никуда. В этом весь смысл: чеки, договоры, медицинские письма и документы, удостоверяющие личность, — это как раз те файлы, которые не стоит отдавать случайному сайту-конвертеру ради бесплатного OCR.
Когда это пригодится
- Фотографии бумажных документов, которые вы хотите потом находить поиском — чеки, гарантии, письма, бланки.
- Сканы, которые вышли со сканера обычными изображениями.
- Всё, что вы не хотели бы вставлять на чужой сайт.
Почему важно положение слов в текстовом слое
Распознанные слова не просто добавляются в конец файла — каждое из них невидимо размещается в тех координатах, где оно находится на фото. Именно поэтому выделение ощущается естественным: проведите по изображению, и подсветка следует за печатными строками; найдите слово поиском, и просмотрщик перейдёт в нужное место страницы. Геометрия приблизительная — так же, как в файлах, которые создают офисные сканеры, и для поиска и копирования этого достаточно.
Честные ограничения
OCR на устройстве медленнее серверной фермы и распознаёт печатный текст, а не рукописный. Очень мелкий или размытый текст может распознаться неверно — экспорт в .txt позволяет легко это проверить. Для скорости распознавания изображения уменьшаются примерно до 2500 px по длинной стороне; встроенное в PDF изображение сохраняет до 4000 px, что печатается чётко на листе стандартного размера.
Если вы делаете это часто
Этот инструмент — разовый конвертер. Если ваша фотоплёнка — это место, где документы исчезают навсегда, для этого и существует Paperlock: он сканирует, распознаёт и раскладывает по местам ваши бумаги прямо на iPhone — по тому же правилу, что ничто не покидает устройство незашифрованным.