Hoe je foto's omzet naar een doorzoekbare PDF
- Voeg je afbeeldingen toe. Sleep JPG-, PNG- of WebP-foto's naar de tool, of tik om ze te kiezen. Elke pagina verschijnt als een kaart — sleep de handgreep om te herschikken, of verwijder de pagina's die je niet wilt.
- Kies de taal. Kies de taal waarin de documenten zijn geschreven. De herkenningsdata voor die taal wordt eenmalig gedownload (de grootte staat naast de kiezer) — je afbeeldingen verlaten nog steeds nooit je apparaat.
- Herken. Klik op Tekst herkennen en zie de kaart van elke pagina van wachten naar klaar gaan, met een live woordentelling. Je kunt tussentijds annuleren; er wordt niets bewaard.
- Controleer en download. De herkende tekst wordt per pagina getoond zodat je hem kunt controleren voordat je erop vertrouwt. Geef het uitvoerbestand een naam, download dan de doorzoekbare PDF, haal de platte .txt op, of kopieer alles naar het klembord.
Wat het doet
- Echte OCR in je browser — bestanden worden nergens geüpload
- Meerdere foto's worden één meerpagina-PDF, in de volgorde die je kiest
- Onzichtbare tekstlaag: de PDF ziet eruit als je foto maar is doorzoekbaar en kopieerbaar
- 15 herkenningstalen, op aanvraag gedownload
- Exporteert ook de platte herkende tekst als .txt-bestand
Wat een doorzoekbare PDF eigenlijk is
Een foto van een bonnetje is gewoon pixels — je kunt er niet in zoeken, het totaal niet selecteren, of de naam van de winkel niet kopiëren. Een doorzoekbare PDF voegt een tweede, onzichtbare laag toe boven op de afbeelding: de herkende tekst, geplaatst waar hij op de foto staat. De pagina ziet er nog steeds precies uit als je foto, maar Preview, Adobe Reader, Spotlight en elk documentsysteem kunnen hem nu lezen.
Deze tool bouwt dat bestand in je browser. Hij decodeert je afbeeldingen, draait de open-source Tesseract-herkenningsengine gecompileerd naar WebAssembly, en stelt een PDF samen met pdf-lib — allemaal in de pagina die je nu bekijkt. Er wordt niets verzonden. Dat is het hele punt: bonnetjes, contracten, medische brieven en identiteitsdocumenten zijn precies de bestanden die je niet aan een willekeurige converter-website zou moeten geven in ruil voor gratis OCR.
Wanneer je dit gebruikt
- Foto's van papieren documenten die je later terug wilt kunnen vinden — bonnetjes, garanties, brieven, formulieren.
- Scans die uit een scanner kwamen als platte afbeeldingen.
- Alles wat je niet in het formulier van een onbekende website zou plakken.
Waarom positie belangrijk is in de tekstlaag
De herkende woorden worden niet zomaar aan het bestand toegevoegd — elk woord wordt onzichtbaar geplaatst op de coördinaten waar het op de foto staat. Dat is wat selecteren natuurlijk laat aanvoelen: sleep over de afbeelding en de markering volgt de gedrukte regels, zoek naar een woord en de viewer springt naar de juiste plek op de pagina. De geometrie is bij benadering, net als in bestanden die kantoorscanners produceren, en dat is prima voor vinden en kopiëren.
Eerlijke beperkingen
OCR op je eigen apparaat is trager dan een serverfarm, en leest gedrukte tekst, geen handschrift. Heel kleine of vage tekst kan verkeerd uitpakken — de .txt-export maakt het makkelijk om te controleren. Afbeeldingen worden voor de herkenningssnelheid verkleind tot ongeveer 2.500 px op de lange zijde; de ingesloten paginaafbeelding behoudt tot 4.000 px, wat netjes afdrukt op briefformaat.
Als je dit vaak doet
Deze tool is een eenmalige converter. Als je cameraroll de plek is waar documenten verdwijnen, is dat precies het probleem waarvoor Paperlock bestaat: het scant, leest en archiveert je papierwerk op je iPhone — met dezelfde regel dat niets onversleuteld je apparaat verlaat.