L'OCR signifie reconnaissance optique de caractères, ce qui est un nom compliqué pour une idée simple : un logiciel qui examine une photo de texte — une photographie, un scan, une page PDF — et identifie les lettres et les chiffres qu'elle contient.

C'est important parce qu'une photo de reçu, pour un ordinateur, n'est qu'une grille de points colorés. Il ne peut pas la chercher, la copier ou lire le montant. Appliquez l'OCR à cette photo et les points deviennent du texte réel : « Blue Bottle Coffee… $14.20… » Maintenant, l'ordinateur peut la trouver quand vous cherchez, comme il trouve un e-mail.

C'est tout le concept. Une photo de mots qui entre, du texte consultable qui sort. Tout le reste sur l'OCR est un détail — y compris le détail sur les raisons pour lesquelles, même avec l'OCR partout, vous ne trouvez toujours pas la garantie de votre lave-vaisselle. Nous allons y venir.

Vous utilisez déjà l'OCR tous les jours

L'OCR semble être un logiciel d'entreprise des années 2000, mais vous l'avez probablement utilisé ce matin sans le remarquer :

  • Recherche de photos sur votre iPhone. Apple appelle sa version Live Text. Votre téléphone lit tranquillement le texte de chaque photo que vous prenez, ce qui vous permet de chercher des mots sur un panneau ou un reçu dans vos photos et d'obtenir vraiment des résultats. Vous pouvez aussi appuyer sur n'importe quelle photo et copier le texte directement.
  • Applications de scan. Quand vous scannez un document avec votre iPhone, l'appli prend la photo — et c'est l'OCR qui rend le PDF résultant consultable au lieu de rester une simple image impossible à chercher.
  • Votre banque. Versez un chèque en le photographiant, et l'OCR lit le montant et les numéros de compte.
  • Le courrier. Les services postaux utilisent l'OCR pour lire les adresses et trier les enveloppes depuis des décennies. C'est une vraie technologie ancienne qui s'est lentement améliorée.

Donc quand une appli de scan annonce « PDFs consultables », c'est de l'OCR. Ce n'est pas une marque ou un produit — c'est le nom générique pour apprendre aux ordinateurs à lire.

Comment ça marche, grosso modo

Vous n'avez pas besoin des détails techniques, mais la version d'un paragraphe vous aide à prévoir quand ça échouera.

Le logiciel OCR cherche la forme des caractères : ce groupe de pixels sombres courbe comme un « S », celui-ci a la barre du « t ». L'OCR moderne excelle pour le texte imprimé propre — bonne lumière, page à plat, polices ordinaires. Il enchaîne ensuite les caractères en mots et les mots en lignes, et vous donne le résultat sous forme de texte brut.

Remarquez ce qui se passe : il reconnaît des caractères. Pas des reçus, pas des contrats, pas « ce nombre est un total et celui-ci est une date ». Des caractères. Gardez ça en tête, parce que c'est la fissure par laquelle tout s'effondre.

Où l'OCR peine vraiment

Trois limites reviennent sans cesse dans la vraie vie :

L'écriture manuscrite. Le texte imprimé n'est pas un problème ; votre écriture manuscrite, oui. Les lettres d'imprimerie nettes s'en tirent généralement bien. La cursive, les notes serrées en marge et tout ce qu'écrit un médecin sortent estropié ou pas du tout. Si vos documents importants incluent des pages manuscrites, l'OCR simple vous décevra.

Les mises en page. L'OCR lit de gauche à droite, de haut en bas. Les vrais documents ne coopèrent pas : les reçus mettent les prix dans une colonne de droite irrégulière, les formulaires éparpillent les étiquettes et les cases partout, les tableaux deviennent du charabia. Les caractères peuvent tous être corrects tandis que l'ordre n'a pas de sens — « Total 3 $14.20 Qty Oat Latte. »

Le contexte. C'est le plus important. L'OCR peut vous dire qu'une page contient les caractères « 03/15/2027 ». Il ne peut pas vous dire si c'est une date d'expiration, une date d'achat ou le jour où le formulaire a été imprimé. Il sait quelles sont les lettres, pas ce qu'elles signifient.

Pourquoi un texte consultable n'est pas encore un document trouvable

Voici la conséquence quotidienne de cette dernière limite. Supposons que l'OCR ait parfaitement fait son travail et que chaque scan sur votre téléphone soit entièrement consultable. Vous avez besoin de la garantie de votre lave-vaisselle. Que tapez-vous ?

« Garantie » — et vous avez quarante résultats, parce que chaque reçu mentionne une garantie. « Lave-vaisselle » — rien, parce que le reçu dit « BOSCH SHEM63W55N ». Le texte est là ; le sens ne l'est pas. La recherche par mot exact ne fonctionne que si vous vous souvenez d'un mot exact, et la paperasse est précisément ce que vous essayez de ne pas garder en tête.

L'OCR vous donne La compréhension vous donne
Un reçu Les caractères qu'il contient « Un reçu, de Bosch, $649, mars 2025 »
Un scan de passeport Les noms et les numéros sous forme de texte « Votre passeport — expire 03/15/2027 »
Votre question Les correspondances pour les mots exacts Une vraie réponse, avec le document en pièce jointe

L'étape après l'OCR : savoir ce qu'est un document

L'étape suivante est un logiciel qui ne s'arrête pas à la lecture des caractères mais détermine ce qu'est le document : un reçu, de qui, pour combien, expirant quand. Une fois cela établi, « où est la garantie du lave-vaisselle ? » devient une question qui a une réponse plutôt qu'un jeu de devinettes sur les mots qui apparaissent sur la page.

C'est autour de ça que Paperlock est construit. Vous scannez ou importez un document dans un coffre protégé par Face ID sur votre iPhone, et il lit le document en entier — y compris l'écriture manuscrite — et le comprend : le type, l'expéditeur, les dates, les montants. Pas de dossiers ou de noms ; il classe les choses tout seul. Ensuite, vous posez votre question en français courant — « quand mon passeport expire-t-il ? », « combien ai-je dépensé chez Blue Bottle ? » — et vous avez la réponse avec le document source en pièce jointe. Si la réponse n'est pas dans votre coffre, il vous le dit au lieu de deviner. Tout ce qui a une date d'expiration reçoit des rappels automatiques 30 jours et 7 jours avant. Vous pouvez voir comment ça marche ici ; elle arrive très bientôt sur l'App Store.

Un point important à noter : chaque fois qu'une appli lit vos documents — OCR ou quelque chose de plus intelligent — il vaut la peine de savoir où cette lecture se fait et ce qui est conservé. Nous avons écrit un guide honnête sur si les applis de scan sont sûres et ce qu'il faut vérifier avant d'en utiliser une.

La version courte

L'OCR transforme les photos de texte en texte consultable, et il est discrètement partout — votre galerie photos, votre appli de scan, votre banque. C'est vraiment utile et vraiment limité : peu fiable sur l'écriture manuscrite, confus par les mises en page, aveugle au sens. Il vous donne les lettres ; il ne peut pas vous dire si c'est une garantie de lave-vaisselle ou un reçu de restaurant.

Pour trouver ce dont vous avez besoin, c'est cette dernière lacune qui compte — et c'est ce que l'étape après l'OCR vise à combler.