So verwandelst du Fotos in ein durchsuchbares PDF

  1. Bilder hinzufügen. Ziehe JPG-, PNG- oder WebP-Fotos auf das Tool, oder tippe, um sie auszuwählen. Jede Seite erscheint als Karte — ziehe am Griff, um die Reihenfolge zu ändern, oder entferne, was du nicht brauchst.
  2. Sprache wählen. Wähle die Sprache, in der die Dokumente verfasst sind. Die Erkennungsdaten für diese Sprache werden einmalig heruntergeladen (die Größe steht neben der Auswahl) — deine Bilder verlassen trotzdem nie dein Gerät.
  3. Erkennen. Tippe auf „Text erkennen“ und sieh zu, wie jede Seitenkarte von wartend zu fertig wechselt, mit einer laufenden Wortzahl. Du kannst mitten im Vorgang abbrechen; dann wird nichts gespeichert.
  4. Prüfen und herunterladen. Der erkannte Text wird pro Seite angezeigt, damit du ihn vor dem Vertrauen darauf überprüfen kannst. Benenne die Ausgabedatei, lade dann das durchsuchbare PDF herunter, hol dir die reine .txt-Datei, oder kopiere alles in die Zwischenablage.

Was es kann

  • Echte OCR in deinem Browser — Dateien werden niemals irgendwohin hochgeladen
  • Mehrere Fotos werden zu einem mehrseitigen PDF, in der Reihenfolge deiner Wahl
  • Unsichtbare Textebene: Das PDF sieht aus wie dein Foto, ist aber durchsuchbar und der Text lässt sich kopieren
  • 15 Erkennungssprachen, die bei Bedarf heruntergeladen werden
  • Exportiert den erkannten Text zusätzlich als reine .txt-Datei

Was ein durchsuchbares PDF wirklich ist

Ein Foto einer Quittung besteht nur aus Pixeln — du kannst es nicht durchsuchen, die Summe nicht markieren oder den Namen des Händlers nicht kopieren. Ein durchsuchbares PDF fügt eine zweite, unsichtbare Ebene über dem Bild hinzu: den erkannten Text, positioniert dort, wo er im Bild erscheint. Die Seite sieht weiterhin genau wie dein Foto aus, aber Preview, Adobe Reader, Spotlight und jedes Dokumentensystem können sie jetzt lesen.

Dieses Tool baut diese Datei in deinem Browser. Es dekodiert deine Bilder, führt die Open-Source-Erkennungs-Engine Tesseract, kompiliert nach WebAssembly, aus und setzt mit pdf-lib ein PDF zusammen — alles in der Seite, die du gerade betrachtest. Nichts wird übertragen. Das ist der ganze Sinn: Quittungen, Verträge, Arztbriefe und Ausweisdokumente sind genau die Dateien, die du nicht für kostenlose OCR an eine beliebige Konverter-Website übergeben solltest.

Wann du es nutzt

  • Fotos von Papierdokumenten, die du später wiederfinden willst — Quittungen, Garantien, Briefe, Formulare.
  • Scans, die als reine Bilder aus einem Scanner kamen.
  • Alles, was du nicht auf die Website eines Fremden hochladen würdest.

Warum die Position in der Textebene wichtig ist

Die erkannten Wörter werden nicht einfach an die Datei angehängt — jedes wird unsichtbar genau an den Koordinaten platziert, an denen es im Foto erscheint. Das lässt die Auswahl natürlich wirken: Ziehe über das Bild, und die Markierung folgt den gedruckten Zeilen; suche nach einem Wort, und der Viewer springt an die richtige Stelle auf der Seite. Die Geometrie ist ungefähr, genau wie bei Dateien aus Bürofoto-Scannern, und das reicht zum Finden und Kopieren völlig aus.

Ehrliche Grenzen

OCR auf dem Gerät ist langsamer als eine Serverfarm und liest gedruckten Text, keine Handschrift. Sehr kleiner oder unscharfer Text kann falsch erkannt werden — der .txt-Export macht die Kontrolle einfach. Bilder werden für die Erkennungsgeschwindigkeit auf etwa 2.500 px an der langen Kante verkleinert; das eingebettete Seitenbild behält bis zu 4.000 px, was im Letter-Format sauber druckt.

Wenn du das oft machst

Dieses Tool ist ein Einmal-Konverter. Wenn deine Fotomediathek der Ort ist, an dem Dokumente verschwinden, ist genau dafür Paperlock da: Es scannt, liest und archiviert deine Papiere auf deinem iPhone — nach derselben Regel, dass nichts unverschlüsselt dein Gerät verlässt.