Näin muutat valokuvat haettavaksi PDF:ksi
- Lisää kuvasi. Pudota JPG-, PNG- tai WebP-valokuvia työkaluun, tai napauta valitaksesi ne. Jokainen sivu näkyy korttina — vedä kahvasta järjestääksesi uudelleen, tai poista ne joita et halua.
- Valitse kieli. Valitse kieli jolla asiakirjat on kirjoitettu. Kyseisen kielen tunnistusdata ladataan kerran (koko näkyy valitsimen vieressä) — kuvasi eivät silti koskaan poistu laitteeltasi.
- Tunnista. Napauta Tunnista teksti ja katso kunkin sivun kortin siirtyvän odottavasta valmiiseen, elävän sananlaskurin kanssa. Voit peruuttaa kesken kaiken; mitään ei säilytetä.
- Tarkista ja lataa. Tunnistettu teksti näytetään sivuittain, joten voit varmistaa sen ennen kuin luotat siihen. Nimeä tulostiedosto, lataa sitten haettava PDF, hae pelkkä .txt, tai kopioi kaikki leikepöydälle.
Mitä se tekee
- Oikea tekstintunnistus selaimessasi — tiedostoja ei koskaan ladata minnekään
- Useasta valokuvasta yksi monisivuinen PDF, valitsemassasi järjestyksessä
- Näkymätön tekstikerros: PDF näyttää valokuvaltasi mutta on haettava ja kopioitava
- 15 tunnistuskieltä, ladataan tarvittaessa
- Vie myös pelkän tunnistetun tekstin .txt-tiedostona
Mitä haettava PDF oikeasti on
Valokuva kuitista on vain pikseleitä — et voi hakea siitä, valita summaa, tai kopioida myyjän nimeä. Haettava PDF lisää kuvan päälle toisen, näkymättömän kerroksen: tunnistetun tekstin, sijoitettuna sinne missä se kuvassa näkyy. Sivu näyttää yhä täsmälleen valokuvaltasi, mutta Preview, Adobe Reader, Spotlight ja jokainen asiakirjajärjestelmä voi nyt lukea sen.
Tämä työkalu rakentaa kyseisen tiedoston selaimessasi. Se dekoodaa kuvasi, ajaa avoimen lähdekoodin Tesseract-tunnistusmoottorin WebAssemblyksi käännettynä, ja kokoaa PDF:n pdf-libillä — kaikki sivulla jota juuri katsot. Mitään ei lähetetä. Se on koko pointti: kuitit, sopimukset, lääkärinkirjeet ja henkilöasiakirjat ovat juuri niitä tiedostoja, joita ei pitäisi antaa satunnaiselle muunnossivustolle ilmaisen OCR:n vastineeksi.
Milloin käyttää tätä
- Valokuvat paperiasiakirjoista, jotka haluat löytää myöhemmin — kuitit, takuut, kirjeet, lomakkeet.
- Skannerista tulleet skannaukset pelkkinä kuvina.
- Mikä tahansa, mitä et liittäisi tuntemattomalle verkkosivustolle.
Miksi sijainti on tärkeä tekstikerroksessa
Tunnistetut sanat eivät vain liity tiedoston perään — jokainen sijoitetaan näkymättömästi niihin koordinaatteihin, joissa se kuvassa esiintyy. Se saa valinnan tuntumaan luonnolliselta: vedä yli kuvan ja korostus seuraa painettuja rivejä, hae sanaa ja katseluohjelma hyppää oikeaan kohtaan sivulla. Geometria on likimääräinen, samaan tapaan kuin toimistoskannerien tuottamissa tiedostoissa, ja se riittää löytämiseen ja kopiointiin.
Rehelliset rajoitukset
Laitteella tapahtuva OCR on hitaampaa kuin palvelinfarmi, ja se lukee painettua tekstiä, ei käsialaa. Hyvin pieni tai epätarkka teksti voi tulla väärin — .txt-vienti tekee tarkistamisesta helppoa. Kuvat pienennetään noin 2 500 pikseliin pitkältä sivultaan tunnistusnopeuden vuoksi; upotettu sivukuva säilyttää jopa 4 000 pikseliä, mikä tulostuu siististi kirjekokoon.
Jos teet tätä usein
Tämä työkalu on kertakäyttöinen muunnin. Jos kameran rullasi on paikka, jonne asiakirjat katoavat, juuri sitä ongelmaa varten Paperlock on olemassa: se skannaa, lukee ja arkistoi paperiasiasi iPhonellasi — samalla säännöllä että mikään ei poistu laitteeltasi salaamattomana.