Ako zmeniť fotky na prehľadávateľné PDF
- Pridajte svoje obrázky. Presuňte fotky vo formáte JPG, PNG alebo WebP do nástroja, alebo ich vyberte ťuknutím. Každá strana sa zobrazí ako kartička — potiahnutím úchytky zmeníte poradie alebo odstránite tie, ktoré nepotrebujete.
- Vyberte jazyk. Zvoľte jazyk, v ktorom sú dokumenty napísané. Rozpoznávacie dáta pre daný jazyk sa stiahnu iba raz (veľkosť je zobrazená vedľa výberu) — vaše obrázky pritom stále nikdy neopustia vaše zariadenie.
- Rozpoznajte text. Kliknite na Rozpoznať text a sledujte, ako kartička každej strany prechádza od čakania po dokončenie, s priebežným počtom rozpoznaných slov. Proces môžete kedykoľvek zrušiť — nič sa neuchováva.
- Skontrolujte a stiahnite. Rozpoznaný text sa zobrazuje pri každej strane, takže si ho môžete overiť, než mu budete dôverovať. Pomenujte výstupný súbor a potom stiahnite prehľadávateľné PDF, obyčajný súbor .txt, alebo skopírujte celý text do schránky.
Čo robí
- Skutočné OCR priamo vo vašom prehliadači — súbory sa nikam nenahrávajú
- Z viacerých fotiek vznikne jedno viacstranové PDF, v poradí, aké si zvolíte
- Neviditeľná vrstva textu: PDF vyzerá ako vaša fotka, ale dá sa v ňom vyhľadávať a kopírovať z neho
- 15 jazykov na rozpoznávanie, sťahovaných podľa potreby
- Rozpoznaný text tiež exportuje ako obyčajný súbor .txt
Čo je to vlastne prehľadávateľné PDF
Fotka účtenky sú len pixely — nemôžete v nej vyhľadávať, označiť sumu ani skopírovať názov obchodu. Prehľadávateľné PDF pridáva nad obrázok druhú, neviditeľnú vrstvu: rozpoznaný text, umiestnený presne tam, kde sa objavuje na obrázku. Strana stále vyzerá presne ako vaša fotka, no Preview, Adobe Reader, Spotlight a každý dokumentový systém ju teraz dokáže prečítať.
Tento nástroj vytvára takýto súbor priamo vo vašom prehliadači. Dekóduje vaše obrázky, spúšťa open-source rozpoznávací engine Tesseract skompilovaný do WebAssembly a zostavuje PDF pomocou pdf-lib — to všetko na stránke, na ktorú sa práve pozeráte. Nič sa neprenáša. O to celé ide: účtenky, zmluvy, lekárske listy a doklady totožnosti sú presne tie súbory, ktoré by ste nemali odovzdať náhodnej konvertovacej stránke výmenou za bezplatné OCR.
Kedy ho použiť
- Fotky papierových dokumentov, ktoré chcete neskôr vedieť nájsť — účtenky, záručné listy, listy, formuláre.
- Skeny, ktoré zo skeneru vyšli ako obyčajné obrázky.
- Čokoľvek, čo by ste nevložili do cudzej webovej stránky.
Prečo na polohe v textovej vrstve záleží
Rozpoznané slová sa do súboru len tak nepridávajú — každé je neviditeľne umiestnené na súradniciach, kde sa nachádza na fotke. Práve to robí označovanie prirodzeným: potiahnete cez obrázok a zvýraznenie sleduje vytlačené riadky, vyhľadáte slovo a prehliadač skočí na správne miesto na strane. Geometria je približná, rovnako ako v súboroch vytvorených kancelárskymi skenermi, a to na vyhľadávanie a kopírovanie plne stačí.
Úprimne o obmedzeniach
OCR priamo v zariadení je pomalšie než serverová farma a číta tlačený text, nie rukopis. Veľmi drobný alebo rozmazaný text sa môže rozpoznať nesprávne — export do .txt vám umožní si to jednoducho overiť. Obrázky sa pre rýchlosť rozpoznávania zmenšia na približne 2 500 px na dlhšej strane; vložený obrázok strany si zachová až 4 000 px, čo sa dá čisto vytlačiť na formát letter.
Ak to robíte často
Tento nástroj je jednorazový konvertor. Ak sa vám dokumenty strácajú vo fotogalérii, presne na to existuje Paperlock: skenuje, číta a triedi vaše papierovanie priamo na vašom iPhone — s rovnakým pravidlom, že nič neopustí vaše zariadenie nezašifrované.