Sådan laver du billeder om til en søgbar PDF
- Tilføj dine billeder. Slip JPG-, PNG- eller WebP-fotos ned på værktøjet, eller tryk for at vælge dem. Hver side vises som et kort — træk i håndtaget for at omarrangere, eller fjern dem, du ikke vil have.
- Vælg sproget. Vælg det sprog, dokumenterne er skrevet på. Genkendelsesdataene for det sprog downloades én gang (størrelsen vises ved siden af vælgeren) — dine billeder forlader stadig aldrig din enhed.
- Genkend. Tryk på Genkend tekst, og se hvert sidekort bevæge sig fra venter til færdig, med et løbende ordantal. Du kan afbryde undervejs; intet bliver gemt.
- Tjek og download. Den genkendte tekst vises pr. side, så du kan kontrollere den, før du stoler på den. Navngiv outputfilen, og download derefter den søgbare PDF, hent den rene .txt-fil, eller kopiér alt til udklipsholderen.
Hvad det gør
- Rigtig OCR i din browser — filer uploades aldrig nogen steder
- Flere fotos bliver til én PDF med flere sider, i den rækkefølge du vælger
- Usynligt tekstlag: PDF'en ligner dit foto, men er søgbar og kan kopieres fra
- 15 genkendelsessprog, der downloades efter behov
- Eksporterer også den rene genkendte tekst som en .txt-fil
Hvad en søgbar PDF egentlig er
Et foto af en kvittering er bare pixels — du kan ikke søge i det, markere totalen eller kopiere forhandlerens navn. En søgbar PDF tilføjer et andet, usynligt lag oven på billedet: den genkendte tekst, placeret der hvor den fremstår på billedet. Siden ligner stadig præcis dit foto, men Preview, Adobe Reader, Spotlight og ethvert dokumentsystem kan nu læse den.
Dette værktøj bygger den fil i din browser. Det afkoder dine billeder, kører den open source-genkendelsesmotor Tesseract, kompileret til WebAssembly, og samler en PDF med pdf-lib — alt sammen på den side, du kigger på. Intet overføres. Det er hele pointen: kvitteringer, kontrakter, lægebreve og ID-dokumenter er præcis de filer, du ikke bør give til en tilfældig konverteringsside i bytte for gratis OCR.
Hvornår du skal bruge det
- Fotos af papirdokumenter, som du gerne vil kunne finde senere — kvitteringer, garantier, breve, formularer.
- Skanninger, der kom ud af en skanner som almindelige billeder.
- Alt, du ikke ville indsætte på en fremmed hjemmeside.
Hvorfor position betyder noget i tekstlaget
De genkendte ord bliver ikke bare tilføjet til filen — hvert ord placeres usynligt ved de koordinater, hvor det fremstår på fotoet. Det er det, der får markeringen til at føles naturlig: træk hen over billedet, og markeringen følger de trykte linjer, søg efter et ord, og fremviseren hopper til det rette sted på siden. Geometrien er tilnærmet, ligesom i filer produceret af kontorskannere, og det er fint til at finde og kopiere tekst.
Ærlige begrænsninger
OCR på selve enheden er langsommere end en serverfarm, og den læser trykt tekst, ikke håndskrift. Meget småt eller sløret tekst kan komme forkert ud — .txt-eksporten gør det nemt at tjekke. Billeder skaleres ned til omkring 2.500 px på den lange side for at holde genkendelsen hurtig; det indlejrede sidebillede beholder op til 4.000 px, som printer rent i letter-størrelse.
Hvis du gør dette ofte
Dette værktøj er en engangskonverter. Hvis din kamerarulle er der, hvor dokumenter går hen for at forsvinde, er det præcis det problem, Paperlock findes for: den skanner, læser og arkiverer dine papirer på din iPhone — med samme regel om, at intet forlader din enhed ukrypteret.