Jak proměnit fotky v prohledávatelné PDF
- Přidejte obrázky. Přetáhněte fotky JPG, PNG nebo WebP do nástroje, nebo klepnutím vyberte soubory. Každá stránka se zobrazí jako karta — přetažením úchytu ji přeuspořádáte, nepotřebné odeberete.
- Vyberte jazyk. Zvolte jazyk, ve kterém jsou dokumenty napsané. Data pro rozpoznávání daného jazyka se jednou stáhnou (velikost je uvedena vedle výběru) — vaše obrázky přesto nikdy neopustí zařízení.
- Rozpoznejte text. Klepněte na Rozpoznat text a sledujte, jak se karta každé stránky mění z čekání na hotovo, s průběžným počtem slov. Průběh lze kdykoli zrušit; nic se přitom neukládá.
- Zkontrolujte a stáhněte. Rozpoznaný text se zobrazí u každé stránky, takže si ho můžete ověřit, než se na něj spolehnete. Pojmenujte výsledný soubor a stáhněte prohledávatelné PDF, získejte prostý .txt, nebo zkopírujte vše do schránky.
Co dělá
- Skutečné OCR přímo v prohlížeči — soubory se nikam nenahrávají
- Z více fotek vznikne jedno vícestránkové PDF v pořadí, které zvolíte
- Neviditelná textová vrstva: PDF vypadá jako vaše fotka, ale je prohledávatelné a text lze kopírovat
- 15 jazyků rozpoznávání, stahují se podle potřeby
- Rozpoznaný text lze exportovat i jako čistý soubor .txt
Co je to vlastně prohledávatelné PDF
Fotka účtenky jsou jen pixely — nedá se v ní vyhledávat, nejde v ní označit celková částka ani zkopírovat jméno prodejce. Prohledávatelné PDF přidává nad obrázek druhou, neviditelnou vrstvu: rozpoznaný text umístěný přesně tam, kde se objevuje na snímku. Stránka pořád vypadá přesně jako vaše fotka, ale Preview, Adobe Reader, Spotlight i každý dokumentový systém ji teď dokážou přečíst.
Tento nástroj takový soubor sestaví přímo ve vašem prohlížeči. Dekóduje vaše obrázky, spustí open-source rozpoznávací engine Tesseract zkompilovaný do WebAssembly a pomocí pdf-lib sestaví PDF — to vše na stránce, kterou máte právě otevřenou. Nic se nikam nepřenáší. O to tu celou dobu jde: účtenky, smlouvy, lékařské zprávy a doklady totožnosti jsou přesně ty soubory, které byste neměli svěřovat náhodné převodní webové stránce výměnou za bezplatné OCR.
Kdy ho použít
- Fotky papírových dokumentů, které chcete později umět dohledat — účtenky, záruční listy, dopisy, formuláře.
- Skeny, které ze skeneru vyšly jako obyčejné obrázky.
- Cokoli, co byste nevložili na cizí webovou stránku.
Proč na pozici v textové vrstvě záleží
Rozpoznaná slova se do souboru nepřidávají jen tak na konec — každé z nich se umístí neviditelně na souřadnice, na kterých se objevuje na fotce. Právě díky tomu se označování textu chová přirozeně: přetáhnete kurzor přes obrázek a zvýraznění sleduje vytištěné řádky, vyhledáte slovo a prohlížeč skočí na správné místo na stránce. Geometrie je jen přibližná, stejně jako u souborů z kancelářských skenerů, a pro vyhledávání a kopírování to plně stačí.
Poctivá omezení
OCR přímo v zařízení je pomalejší než serverová farma a umí číst tištěný text, ne rukopis. Velmi drobný nebo rozostřený text se může rozpoznat špatně — export do .txt vám umožní si to snadno ověřit. Obrázky se pro rychlejší rozpoznávání zmenší přibližně na 2 500 px na delší straně; vložený obrázek stránky si drží až 4 000 px, což se čistě vytiskne i ve formátu dopisního papíru.
Pokud to děláte často
Tento nástroj je jednorázový převodník. Pokud je vaše fotogalerie místem, kde dokumenty mizí v propadlišti dějin, přesně od toho tu je Paperlock: skenuje, přečte a uloží vaše papírování přímo ve vašem iPhonu — se stejným pravidlem, že nic neopustí zařízení nezašifrované.