Come trasformare foto in un PDF ricercabile

  1. Aggiungi le tue immagini. Trascina foto JPG, PNG o WebP sullo strumento, oppure tocca per sceglierle. Ogni pagina appare come una scheda — trascina la maniglia per riordinare, o rimuovi quelle che non ti servono.
  2. Scegli la lingua. Seleziona la lingua in cui sono scritti i documenti. I dati di riconoscimento per quella lingua si scaricano una sola volta (la dimensione è indicata accanto al selettore) — le tue immagini comunque non lasciano mai il dispositivo.
  3. Riconosci. Tocca Riconosci testo e osserva la scheda di ogni pagina passare da in attesa a completata, con un conteggio delle parole in tempo reale. Puoi annullare a metà elaborazione; non resta nulla salvato.
  4. Controlla e scarica. Il testo riconosciuto viene mostrato per ogni pagina, così puoi verificarlo prima di fidartene. Assegna un nome al file di output, poi scarica il PDF ricercabile, prendi il .txt semplice, oppure copia tutto negli appunti.

Cosa fa

  • Vero OCR nel browser — i file non vengono mai caricati da nessuna parte
  • Più foto diventano un unico PDF multipagina, nell'ordine che scegli tu
  • Livello di testo invisibile: il PDF ha l'aspetto della tua foto ma è ricercabile e copiabile
  • 15 lingue di riconoscimento, scaricate all'occorrenza
  • Esporta anche il testo riconosciuto puro come file .txt

Cos'è davvero un PDF ricercabile

La foto di uno scontrino è solo un insieme di pixel — non puoi cercarci dentro, selezionare il totale o copiare il nome del negozio. Un PDF ricercabile aggiunge un secondo livello invisibile sopra l'immagine: il testo riconosciuto, posizionato dove compare nella foto. La pagina continua ad avere l'aspetto della tua foto, ma ora Anteprima, Adobe Reader, Spotlight e qualsiasi sistema di gestione documenti possono leggerla.

Questo strumento costruisce quel file nel tuo browser. Decodifica le immagini, esegue il motore di riconoscimento open source Tesseract compilato in WebAssembly, e assembla un PDF con pdf-lib — tutto nella pagina che stai guardando. Non viene trasmesso nulla. È proprio questo il punto: scontrini, contratti, lettere mediche e documenti d'identità sono esattamente i file che non dovresti consegnare a un sito di conversione qualsiasi in cambio di OCR gratuito.

Quando usarlo

  • Foto di documenti cartacei che vuoi poter ritrovare in seguito — scontrini, garanzie, lettere, moduli.
  • Scansioni uscite da uno scanner come semplici immagini.
  • Qualsiasi cosa che non incolleresti sul sito di uno sconosciuto.

Perché la posizione conta nel livello di testo

Le parole riconosciute non vengono semplicemente aggiunte in coda al file — ognuna viene posizionata in modo invisibile alle coordinate in cui compare nella foto. È questo che rende naturale la selezione: trascini sull'immagine e l'evidenziazione segue le righe stampate, cerchi una parola e il visualizzatore salta al punto giusto della pagina. La geometria è approssimativa, come avviene anche nei file prodotti dagli scanner d'ufficio, ma va benissimo per trovare e copiare.

Limiti onesti

L'OCR eseguito sul dispositivo è più lento di una server farm, e legge testo stampato, non scrittura a mano. Caratteri molto piccoli o sfocati possono uscire sbagliati — l'esportazione in .txt rende facile controllare. Le immagini vengono ridotte a circa 2.500 px sul lato lungo per la velocità di riconoscimento; l'immagine di pagina incorporata mantiene fino a 4.000 px, che stampa bene in formato lettera.

Se lo fai spesso

Questo strumento è un convertitore da usare una volta sola. Se il tuo rullino fotografico è il posto dove i documenti vanno a sparire, è esattamente il problema per cui esiste Paperlock: scansiona, legge e archivia le tue carte sul tuo iPhone — con la stessa regola che nulla lascia il dispositivo non cifrato.