Hogyan alakítsunk fotókat kereshető PDF-fé

  1. Adja hozzá a képeket. Húzzon JPG, PNG vagy WebP fotókat az eszközre, vagy koppintson a kiválasztáshoz. Minden oldal egy kártyaként jelenik meg — húzza a fogantyút az átrendezéshez, vagy távolítsa el a nem kívánt oldalakat.
  2. Válassza ki a nyelvet. Válassza ki, milyen nyelven íródtak a dokumentumok. Az adott nyelv felismerési adatai egyszer töltődnek le (a méret a választó mellett látható) — a képei így is mindvégig az eszközén maradnak.
  3. Ismertesse fel. Kattintson a Szöveg felismerése gombra, és nézze, ahogy az egyes oldalak kártyái a várakozásból a kész állapotba lépnek, élő szószámlálóval. A folyamat közben megszakíthatja; semmi nem marad megőrizve.
  4. Ellenőrizze és töltse le. A felismert szöveg oldalanként jelenik meg, így ellenőrizheti, mielőtt megbízna benne. Nevezze el a kimeneti fájlt, majd töltse le a kereshető PDF-et, szerezze meg az egyszerű .txt fájlt, vagy másolja ki az egészet a vágólapra.

Mit csinál

  • Valódi OCR a böngészőjében — a fájlok sosem kerülnek feltöltésre
  • Több fotóból egyetlen, több oldalas PDF lesz, az Ön által megadott sorrendben
  • Láthatatlan szövegréteg: a PDF úgy néz ki, mint a fotója, de kereshető és másolható
  • 15 felismerési nyelv, igény szerint letöltve
  • A felismert egyszerű szöveget .txt fájlként is exportálja

Mi is valójában a kereshető PDF

Egy nyugta fotója csak pixelekből áll — nem tud benne keresni, nem jelölheti ki a végösszeget, és nem másolhatja ki a kereskedő nevét. A kereshető PDF egy második, láthatatlan réteget ad a kép tetejére: a felismert szöveget, ott elhelyezve, ahol a képen megjelenik. Az oldal pontosan úgy néz ki, mint a fotója, de a Preview, az Adobe Reader, a Spotlight és minden dokumentumkezelő rendszer immár el tudja olvasni.

Ez az eszköz az Ön böngészőjében építi fel ezt a fájlt. Dekódolja a képeit, lefuttatja a nyílt forráskódú Tesseract felismerőmotort WebAssembly formában, majd a pdf-lib segítségével összeállítja a PDF-et — mindezt azon az oldalon, amelyet éppen néz. Semmi sem kerül továbbításra. Ez az egész lényege: a nyugták, szerződések, orvosi levelek és személyazonosító okmányok pontosan azok a fájlok, amelyeket nem szabad odaadnia egy véletlenszerű konverteroldalnak egy ingyenes OCR-ért cserébe.

Mikor érdemes használni

  • Papíralapú dokumentumokról készült fotók, amelyeket később megtalálhatóvá szeretne tenni — nyugták, garanciák, levelek, űrlapok.
  • Szkennelésből származó, egyszerű képként mentett dokumentumok.
  • Bármi, amit nem illesztene be egy idegen weboldalba.

Miért számít a pozíció a szövegrétegben

A felismert szavak nem egyszerűen hozzáfűzve kerülnek a fájlhoz — mindegyik láthatatlanul azokra a koordinátákra kerül, ahol a fotón megjelenik. Ettől érződik a kijelölés természetesnek: húzza végig a képen, és a kiemelés követi a nyomtatott sorokat, keressen rá egy szóra, és a megjelenítő a lap megfelelő pontjára ugrik. A geometria közelítő jellegű, ugyanúgy, mint az irodai szkennerek által előállított fájlokban, és ez a keresés és másolás szempontjából megfelelő.

Őszinte korlátok

Az eszközön futó OCR lassabb, mint egy szerverfarm, és nyomtatott szöveget olvas, nem kézírást. A nagyon apró vagy homályos szöveg hibásan jöhet ki — a .txt exportálás megkönnyíti az ellenőrzést. A felismeréshez a képeket a hosszabbik oldalukon kb. 2500 px-re kicsinyíti a rendszer; a beágyazott oldalkép akár 4000 px méretet is megtart, amely letter méretben tisztán nyomtatható.

Ha gyakran csinálja ezt

Ez az eszköz egy egyszeri konverter. Ha a fényképtára az, ahol a dokumentumai eltűnnek, pontosan ez a probléma, amiért a Paperlock létezik: beszkenneli, elolvassa és rendszerezi a papírjait az iPhone-ján — ugyanazzal a szabállyal, hogy semmi sem hagyja el titkosítatlanul az eszközét.