Як перетворити фото на PDF з пошуком

  1. Додайте зображення. Перетягніть фото у форматі JPG, PNG або WebP в інструмент або натисніть, щоб обрати їх. Кожна сторінка з’являється як картка — перетягніть ручку, щоб змінити порядок, або приберіть непотрібні.
  2. Оберіть мову. Виберіть мову, якою написані документи. Дані розпізнавання для цієї мови завантажуються один раз (розмір показано біля селектора) — ваші зображення при цьому все одно нікуди не надсилаються.
  3. Розпізнайте. Натисніть «Розпізнати текст» і спостерігайте, як кожна картка сторінки проходить шлях від очікування до завершення, з відліком слів у реальному часі. Процес можна скасувати; нічого не зберігається.
  4. Перевірте й завантажте. Розпізнаний текст показується по кожній сторінці окремо, щоб ви могли перевірити його, перш ніж довіритися результату. Назвіть файл, а потім завантажте PDF з пошуком, візьміть простий .txt або скопіюйте все в буфер обміну.

Що він робить

  • Справжнє OCR у вашому браузері — файли ніколи нікуди не завантажуються
  • Кілька фото стають одним багатосторінковим PDF у обраному вами порядку
  • Невидимий шар тексту: PDF виглядає як ваше фото, але текст можна шукати й копіювати
  • 15 мов розпізнавання, завантажуються за потреби
  • Також експортує розпізнаний текст у форматі .txt

Що таке PDF з пошуком насправді

Фото квитанції — це просто пікселі: у ньому не можна шукати, виділити суму або скопіювати назву продавця. PDF з пошуком додає другий, невидимий шар поверх зображення: розпізнаний текст, розміщений там, де він з’являється на картинці. Сторінка все ще виглядає точно як ваше фото, але Preview, Adobe Reader, Spotlight і будь-яка система документообігу тепер можуть її прочитати.

Цей інструмент створює такий файл у вашому браузері. Він декодує зображення, запускає відкритий рушій розпізнавання Tesseract, скомпільований у WebAssembly, і збирає PDF за допомогою pdf-lib — усе на сторінці, яку ви зараз бачите. Нічого не передається. У цьому весь сенс: квитанції, договори, медичні листи й документи, що посвідчують особу, — це саме ті файли, які не варто віддавати випадковому сайту-конвертеру в обмін на безкоштовне OCR.

Коли це стане в пригоді

  • Фото паперових документів, які ви хочете знаходити пізніше — квитанції, гарантії, листи, форми.
  • Скани, що вийшли зі сканера як прості зображення.
  • Усе, що ви не стали б вставляти на сайт незнайомця.

Чому позиція важлива в шарі тексту

Розпізнані слова не просто додаються в кінець файлу — кожне з них розміщується невидимо саме в тих координатах, де воно є на фото. Саме це робить виділення природним: проведіть по зображенню — і підсвітка йтиме за надрукованими рядками, знайдіть слово через пошук — і переглядач перейде в потрібне місце сторінки. Розташування приблизне, так само як у файлах, що створюють офісні сканери, і для пошуку й копіювання цього достатньо.

Чесні обмеження

OCR на пристрої повільніше за серверну ферму й читає друкований текст, а не рукописний. Дуже дрібний або розмитий текст може розпізнатися неправильно — експорт .txt дозволяє легко це перевірити. Зображення зменшуються приблизно до 2500 px по довшій стороні для швидкості розпізнавання; вбудоване зображення сторінки зберігає до 4000 px, що дає чіткий друк на аркуші стандартного розміру.

Якщо ви робите це часто

Цей інструмент — одноразовий конвертер. Якщо саме у фотоплівці телефона документи й зникають безслідно, це точно та проблема, для якої існує Paperlock: він сканує, читає й впорядковує ваші папери на iPhone — за тим самим правилом, що нічого не залишає пристрій незашифрованим.