Comment transformer des photos en PDF consultable

  1. Ajoutez vos images. Déposez des photos JPG, PNG ou WebP sur l'outil, ou touchez l'écran pour les choisir. Chaque page apparaît sous forme de carte — faites glisser la poignée pour réorganiser, ou retirez celles dont vous ne voulez pas.
  2. Choisissez la langue. Sélectionnez la langue dans laquelle les documents sont rédigés. Les données de reconnaissance pour cette langue se téléchargent une seule fois (la taille est indiquée à côté du sélecteur) — vos images ne quittent toujours jamais votre appareil.
  3. Lancez la reconnaissance. Appuyez sur Reconnaître le texte et regardez la carte de chaque page passer de l'attente à terminé, avec un décompte de mots en direct. Vous pouvez annuler en cours de route ; rien n'est conservé.
  4. Vérifiez et téléchargez. Le texte reconnu s'affiche page par page pour que vous puissiez le vérifier avant de vous y fier. Nommez le fichier de sortie, puis téléchargez le PDF consultable, récupérez le .txt brut, ou copiez tout dans le presse-papiers.

Ce qu'il fait

  • Véritable OCR dans votre navigateur — les fichiers ne sont jamais envoyés où que ce soit
  • Plusieurs photos deviennent un seul PDF multipage, dans l'ordre que vous choisissez
  • Couche de texte invisible : le PDF ressemble à votre photo mais devient consultable et copiable
  • 15 langues de reconnaissance, téléchargées à la demande
  • Exporte aussi le texte reconnu brut sous forme de fichier .txt

Ce qu'est vraiment un PDF consultable

La photo d'un reçu n'est qu'un ensemble de pixels — vous ne pouvez pas y chercher, sélectionner le total ou copier le nom du commerçant. Un PDF consultable ajoute une seconde couche, invisible, par-dessus l'image : le texte reconnu, positionné là où il apparaît sur la photo. La page ressemble toujours exactement à votre photo, mais Preview, Adobe Reader, Spotlight et tous les systèmes documentaires peuvent désormais la lire.

Cet outil construit ce fichier dans votre navigateur. Il décode vos images, exécute le moteur de reconnaissance open source Tesseract compilé en WebAssembly, et assemble un PDF avec pdf-lib — le tout dans la page que vous avez sous les yeux. Rien n'est transmis. C'est tout l'intérêt : reçus, contrats, courriers médicaux et pièces d'identité sont exactement les fichiers qu'il ne faut pas confier à un site convertisseur inconnu en échange d'une OCR gratuite.

Quand l'utiliser

  • Photos de documents papier que vous voulez pouvoir retrouver plus tard — reçus, garanties, courriers, formulaires.
  • Scans sortis d'un scanner sous forme de simples images.
  • Tout ce que vous ne colleriez pas sur le site d'un inconnu.

Pourquoi la position compte dans la couche de texte

Les mots reconnus ne sont pas simplement ajoutés à la fin du fichier — chacun est placé de façon invisible aux coordonnées où il apparaît sur la photo. C'est ce qui rend la sélection naturelle : faites glisser sur l'image et le surlignage suit les lignes imprimées, cherchez un mot et la visionneuse saute au bon endroit sur la page. La géométrie est approximative, comme dans les fichiers produits par les scanners de bureau, ce qui reste très bien pour chercher et copier.

Limites honnêtes

L'OCR effectuée sur l'appareil est plus lente qu'une ferme de serveurs, et elle lit de l'imprimé, pas de l'écriture manuscrite. Un texte très petit ou flou peut être mal reconnu — l'export .txt permet de le vérifier facilement. Les images sont réduites à environ 2 500 px sur le grand côté pour la vitesse de reconnaissance ; l'image de page intégrée conserve jusqu'à 4 000 px, ce qui s'imprime proprement au format lettre.

Si vous faites cela souvent

Cet outil est un convertisseur ponctuel. Si votre pellicule photo est l'endroit où les documents finissent par disparaître, c'est exactement le problème que Paperlock résout : il numérise, lit et classe vos papiers sur votre iPhone — avec la même règle que rien ne quitte votre appareil sans être chiffré.