Як сканувати документ у своєму браузері

  1. Сфотографуйте документ. Натисніть «Зробити фото», щоб скористатися камерою, або перетягніть уже наявне фото. Рівна поверхня, добре освітлення, і станьте так, щоб ваша тінь не падала на аркуш.
  2. Скоригуйте кути. Інструмент пропонує, де розташовані краї документа. Перетягніть будь-який кут, щоб виправити його, — з’являється лупа, щоб ви точно потрапили на край паперу.
  3. Оберіть фільтр. Режим «Документ» робить папір білим, а текст темним, як справжній сканер. Режими «Відтінки сірого» й «Оригінал» доступні, коли вони потрібні.
  4. Додайте сторінки й завантажте. Натискайте «Додати сторінку» для кожного аркуша, за потреби змініть порядок, тоді завантажте все як один PDF.

Що він робить

  • Автоматичне визначення країв (трасування прямих ліній плюс моделювання фону), з чотирикутовою обрізкою, яку можна перетягувати, та лупою для точного налаштування
  • Правильно обробляє повернуті фото з телефону — орієнтація EXIF зчитується й застосовується, включно зі старішим Safari
  • Фільтр для документів, що робить папір білим, а текст чітким — плюс режими відтінків сірого й оригіналу
  • Кілька сторінок: додавайте сторінки, змінюйте їхній порядок і завантажте один PDF
  • Працює з камерою вашого iPhone або будь-яким уже наявним фото
  • Працює повністю у вашому браузері — фото ніколи не надсилається на сервер

Сканер, що працює там, де й мають лишатися ваші документи: на вашому пристрої

Більшість сайтів «безкоштовний онлайн-сканер» працюють однаково: ви завантажуєте фото свого документа на їхній сервер, їхній сервер обробляє його, і ви завантажуєте результат. Для договору оренди, паспорта чи медичного рахунку це дивна угода. Цей сканер виконує ту саму роботу — виправлення перспективи, очищення, збирання PDF — за допомогою JavaScript, що працює у вашому власному браузері. Сторінка, яку ви фотографуєте, ніколи не залишає пристрій, яким ви її сфотографували.

Як це насправді працює

Коли ви обираєте фото, інструмент шукає контур документа двома способами одразу: він трасує найсильніші прямі краї на зображенні (так само, як роблять застосунки-сканери), і окремо моделює фон з країв фото, щоб знайти ділянку, яка не є столом. Коли обидва способи погоджуються, пропозиція обрізки зазвичай точна до кількох пікселів; коли фото складне — заплутаний фон, документ заповнює весь кадр, — інструмент про це повідомляє й починає з розумного варіанту за замовчуванням. Тоді ви виправляєте кути вручну — лупа слідує за вашим пальцем, щоб ви могли точно розмістити кожен кут на справжньому краю паперу. З цих чотирьох кутів інструмент обчислює перспективне перетворення (та сама математика, яку використовують справжні застосунки-сканери) і перепроєктує сторінку в чистий прямокутник. Фільтр «Документ» порівнює кожен піксель з його локальним оточенням, тож папір стає білим, а текст лишається темним, навіть якщо освітлення сторінки було нерівномірним. Насамкінець сторінки вбудовуються в PDF, зібраний повністю в браузері бібліотекою з відкритим кодом.

Як отримати скан, що виглядає як скан

Перетворення може виправити перспективу, але не може вигадати деталі, яких немає на фото. Три звички роблять різницю: світло з вікна, а не з верхньої лампи (менше тіней), телефон, що тримається рівно над сторінкою, а не під кутом (менше спотворень для виправлення), і контрастна поверхня під папером (білий аркуш на білому столі не дає детектору країв нічого знайти — і додає вам більше перетягування кутів).

Чого цей інструмент не робить

Він не читає текст. PDF, який ви завантажуєте, — це набір зображень: чудово підходить для друку, надсилання поштою чи зберігання, але шукати в ньому не можна, і ваш телефон теж не може. Він також нічого не впорядковує: сторінка 3 вашого договору оренди буде точно там, де ви її поклали, у папці «Завантаження». Якщо ви хочете сканувати один раз, а тоді знаходити речі просто запитавши — «яка була сума застави?» — це завдання для сховища документів з OCR, для чого й був створений Paperlock.