Як перетворити фото на PDF з пошуком
- Додайте зображення. Перетягніть фото у форматі JPG, PNG або WebP в інструмент або натисніть, щоб обрати їх. Кожна сторінка з’являється як картка — перетягніть ручку, щоб змінити порядок, або приберіть непотрібні.
- Оберіть мову. Виберіть мову, якою написані документи. Дані розпізнавання для цієї мови завантажуються один раз (розмір показано біля селектора) — ваші зображення при цьому все одно нікуди не надсилаються.
- Розпізнайте. Натисніть «Розпізнати текст» і спостерігайте, як кожна картка сторінки проходить шлях від очікування до завершення, з відліком слів у реальному часі. Процес можна скасувати; нічого не зберігається.
- Перевірте й завантажте. Розпізнаний текст показується по кожній сторінці окремо, щоб ви могли перевірити його, перш ніж довіритися результату. Назвіть файл, а потім завантажте PDF з пошуком, візьміть простий .txt або скопіюйте все в буфер обміну.
Що він робить
- Справжнє OCR у вашому браузері — файли ніколи нікуди не завантажуються
- Кілька фото стають одним багатосторінковим PDF у обраному вами порядку
- Невидимий шар тексту: PDF виглядає як ваше фото, але текст можна шукати й копіювати
- 15 мов розпізнавання, завантажуються за потреби
- Також експортує розпізнаний текст у форматі .txt
Що таке PDF з пошуком насправді
Фото квитанції — це просто пікселі: у ньому не можна шукати, виділити суму або скопіювати назву продавця. PDF з пошуком додає другий, невидимий шар поверх зображення: розпізнаний текст, розміщений там, де він з’являється на картинці. Сторінка все ще виглядає точно як ваше фото, але Preview, Adobe Reader, Spotlight і будь-яка система документообігу тепер можуть її прочитати.
Цей інструмент створює такий файл у вашому браузері. Він декодує зображення, запускає відкритий рушій розпізнавання Tesseract, скомпільований у WebAssembly, і збирає PDF за допомогою pdf-lib — усе на сторінці, яку ви зараз бачите. Нічого не передається. У цьому весь сенс: квитанції, договори, медичні листи й документи, що посвідчують особу, — це саме ті файли, які не варто віддавати випадковому сайту-конвертеру в обмін на безкоштовне OCR.
Коли це стане в пригоді
- Фото паперових документів, які ви хочете знаходити пізніше — квитанції, гарантії, листи, форми.
- Скани, що вийшли зі сканера як прості зображення.
- Усе, що ви не стали б вставляти на сайт незнайомця.
Чому позиція важлива в шарі тексту
Розпізнані слова не просто додаються в кінець файлу — кожне з них розміщується невидимо саме в тих координатах, де воно є на фото. Саме це робить виділення природним: проведіть по зображенню — і підсвітка йтиме за надрукованими рядками, знайдіть слово через пошук — і переглядач перейде в потрібне місце сторінки. Розташування приблизне, так само як у файлах, що створюють офісні сканери, і для пошуку й копіювання цього достатньо.
Чесні обмеження
OCR на пристрої повільніше за серверну ферму й читає друкований текст, а не рукописний. Дуже дрібний або розмитий текст може розпізнатися неправильно — експорт .txt дозволяє легко це перевірити. Зображення зменшуються приблизно до 2500 px по довшій стороні для швидкості розпізнавання; вбудоване зображення сторінки зберігає до 4000 px, що дає чіткий друк на аркуші стандартного розміру.
Якщо ви робите це часто
Цей інструмент — одноразовий конвертер. Якщо саме у фотоплівці телефона документи й зникають безслідно, це точно та проблема, для якої існує Paperlock: він сканує, читає й впорядковує ваші папери на iPhone — за тим самим правилом, що нічого не залишає пристрій незашифрованим.