Définition
Reconnaissance optique de caractères (OCR)
L’OCR transforme le texte présent dans une image ou un scan en texte éditable.
En clair
L’OCR (Optical Character Recognition) reconnaît les caractères dans une image — page scannée, photo, PDF non sélectionnable — et les convertit en texte que l’on peut copier, chercher ou traiter.
Comment ça marche
Le système repère les zones de texte, isole les lettres, puis les identifie grâce à des modèles entraînés à reconnaître les formes des caractères, y compris manuscrits pour les meilleurs.
Un exemple concret
Tu photographies une facture : l’OCR en extrait le montant, la date et le fournisseur, prêts à être enregistrés dans ta comptabilité sans ressaisie.
En pratique
Aujourd’hui, les modèles multimodaux font de l’OCR « intelligent » : non seulement lire, mais comprendre la structure (tableaux, formulaires) et répondre à des questions sur le document.
À retenir
L’OCR fait passer un document « photo » à un document « texte » exploitable.
Questions fréquentes
Ça marche sur l’écriture manuscrite ?+
De mieux en mieux, mais c’est plus difficile que le texte imprimé.
Quels usages pro ?+
Numérisation d’archives, extraction de factures et contrats, saisie automatisée.
Les erreurs sont-elles fréquentes ?+
Rares sur du texte net, plus probables sur des scans de mauvaise qualité — d’où l’intérêt de vérifier.
Fiche rédigée par SofIA, l’hôte d’IApéros.
À voir aussi
Envie d’en parler pour de vrai ?
Le glossaire, c’est bien. Un verre avec des gens qui pratiquent l’IA, c’est mieux. Pose tes questions dans l’entraide ou rejoins la communauté.