Jak proměnit fotky v prohledávatelné PDF

  1. Přidejte obrázky. Přetáhněte fotky JPG, PNG nebo WebP do nástroje, nebo klepnutím vyberte soubory. Každá stránka se zobrazí jako karta — přetažením úchytu ji přeuspořádáte, nepotřebné odeberete.
  2. Vyberte jazyk. Zvolte jazyk, ve kterém jsou dokumenty napsané. Data pro rozpoznávání daného jazyka se jednou stáhnou (velikost je uvedena vedle výběru) — vaše obrázky přesto nikdy neopustí zařízení.
  3. Rozpoznejte text. Klepněte na Rozpoznat text a sledujte, jak se karta každé stránky mění z čekání na hotovo, s průběžným počtem slov. Průběh lze kdykoli zrušit; nic se přitom neukládá.
  4. Zkontrolujte a stáhněte. Rozpoznaný text se zobrazí u každé stránky, takže si ho můžete ověřit, než se na něj spolehnete. Pojmenujte výsledný soubor a stáhněte prohledávatelné PDF, získejte prostý .txt, nebo zkopírujte vše do schránky.

Co dělá

  • Skutečné OCR přímo v prohlížeči — soubory se nikam nenahrávají
  • Z více fotek vznikne jedno vícestránkové PDF v pořadí, které zvolíte
  • Neviditelná textová vrstva: PDF vypadá jako vaše fotka, ale je prohledávatelné a text lze kopírovat
  • 15 jazyků rozpoznávání, stahují se podle potřeby
  • Rozpoznaný text lze exportovat i jako čistý soubor .txt

Co je to vlastně prohledávatelné PDF

Fotka účtenky jsou jen pixely — nedá se v ní vyhledávat, nejde v ní označit celková částka ani zkopírovat jméno prodejce. Prohledávatelné PDF přidává nad obrázek druhou, neviditelnou vrstvu: rozpoznaný text umístěný přesně tam, kde se objevuje na snímku. Stránka pořád vypadá přesně jako vaše fotka, ale Preview, Adobe Reader, Spotlight i každý dokumentový systém ji teď dokážou přečíst.

Tento nástroj takový soubor sestaví přímo ve vašem prohlížeči. Dekóduje vaše obrázky, spustí open-source rozpoznávací engine Tesseract zkompilovaný do WebAssembly a pomocí pdf-lib sestaví PDF — to vše na stránce, kterou máte právě otevřenou. Nic se nikam nepřenáší. O to tu celou dobu jde: účtenky, smlouvy, lékařské zprávy a doklady totožnosti jsou přesně ty soubory, které byste neměli svěřovat náhodné převodní webové stránce výměnou za bezplatné OCR.

Kdy ho použít

  • Fotky papírových dokumentů, které chcete později umět dohledat — účtenky, záruční listy, dopisy, formuláře.
  • Skeny, které ze skeneru vyšly jako obyčejné obrázky.
  • Cokoli, co byste nevložili na cizí webovou stránku.

Proč na pozici v textové vrstvě záleží

Rozpoznaná slova se do souboru nepřidávají jen tak na konec — každé z nich se umístí neviditelně na souřadnice, na kterých se objevuje na fotce. Právě díky tomu se označování textu chová přirozeně: přetáhnete kurzor přes obrázek a zvýraznění sleduje vytištěné řádky, vyhledáte slovo a prohlížeč skočí na správné místo na stránce. Geometrie je jen přibližná, stejně jako u souborů z kancelářských skenerů, a pro vyhledávání a kopírování to plně stačí.

Poctivá omezení

OCR přímo v zařízení je pomalejší než serverová farma a umí číst tištěný text, ne rukopis. Velmi drobný nebo rozostřený text se může rozpoznat špatně — export do .txt vám umožní si to snadno ověřit. Obrázky se pro rychlejší rozpoznávání zmenší přibližně na 2 500 px na delší straně; vložený obrázek stránky si drží až 4 000 px, což se čistě vytiskne i ve formátu dopisního papíru.

Pokud to děláte často

Tento nástroj je jednorázový převodník. Pokud je vaše fotogalerie místem, kde dokumenty mizí v propadlišti dějin, přesně od toho tu je Paperlock: skenuje, přečte a uloží vaše papírování přímo ve vašem iPhonu — se stejným pravidlem, že nic neopustí zařízení nezašifrované.