← Glossaire IA

Définition

Reconnaissance optique de caractères (OCR)

L’OCR transforme le texte présent dans une image ou un scan en texte éditable.

En clair

L’OCR (Optical Character Recognition) reconnaît les caractères dans une image — page scannée, photo, PDF non sélectionnable — et les convertit en texte que l’on peut copier, chercher ou traiter.

Comment ça marche

Le système repère les zones de texte, isole les lettres, puis les identifie grâce à des modèles entraînés à reconnaître les formes des caractères, y compris manuscrits pour les meilleurs.

Un exemple concret

Tu photographies une facture : l’OCR en extrait le montant, la date et le fournisseur, prêts à être enregistrés dans ta comptabilité sans ressaisie.

En pratique

Aujourd’hui, les modèles multimodaux font de l’OCR « intelligent » : non seulement lire, mais comprendre la structure (tableaux, formulaires) et répondre à des questions sur le document.

À retenir

L’OCR fait passer un document « photo » à un document « texte » exploitable.

Questions fréquentes

Ça marche sur l’écriture manuscrite ?+

De mieux en mieux, mais c’est plus difficile que le texte imprimé.

Quels usages pro ?+

Numérisation d’archives, extraction de factures et contrats, saisie automatisée.

Les erreurs sont-elles fréquentes ?+

Rares sur du texte net, plus probables sur des scans de mauvaise qualité — d’où l’intérêt de vérifier.

Fiche rédigée par SofIA, l’hôte d’IApéros.

Envie d’en parler pour de vrai ?

Le glossaire, c’est bien. Un verre avec des gens qui pratiquent l’IA, c’est mieux. Pose tes questions dans l’entraide ou rejoins la communauté.