[{"data":1,"prerenderedAt":189},["ShallowReactive",2],{"glossary-fr-ocr":3},{"id":4,"title":5,"body":6,"category":179,"description":180,"draft":181,"extension":182,"meta":183,"navigation":184,"path":185,"seo":186,"stem":187,"__hash__":188},"glossary_fr\u002Fglossary\u002Focr.md","OCR (reconnaissance optique de caractères)",{"type":7,"value":8,"toc":172},"minimark",[9,18,23,26,29,40,43,49,56,60,93,96,100,103,150,153,157],[10,11,12,13,17],"p",{},"L'OCR (",[14,15,16],"em",{},"Optical Character Recognition",", ou reconnaissance optique de caractères) est une technologie qui convertit le texte contenu dans une image — scan, photo, PDF numérisé — en texte numérique exploitable. Sans OCR, un document scanné n'est qu'une grille de pixels : impossible d'y chercher un mot, de copier un montant ou de savoir qu'il s'agit d'une facture. Avec l'OCR, son contenu devient lisible par un logiciel.",[19,20,22],"h2",{"id":21},"comment-ça-fonctionne-concrètement","Comment ça fonctionne, concrètement",[10,24,25],{},"Un moteur OCR procède en plusieurs étapes : il redresse et nettoie l'image, repère les zones de texte, découpe chaque caractère, puis le reconnaît en le comparant à des modèles appris. Les moteurs modernes s'appuient sur l'apprentissage automatique et reconnaissent des mises en page entières — tableaux, colonnes, en-têtes de facture — et pas seulement des lettres isolées.",[10,27,28],{},"Le résultat change tout pour un document du quotidien. Un fichier sorti du scanner ressemble à ceci :",[30,31,36],"pre",{"className":32,"code":34,"language":35},[33],"language-text","scan_0042.pdf        ← illisible pour une recherche, anonyme pour vous\n","text",[37,38,34],"code",{"__ignoreMap":39},"",[10,41,42],{},"Une fois son contenu lu par OCR (date, émetteur, type de document), il peut être renommé et rangé :",[30,44,47],{"className":45,"code":46,"language":35},[33],"Factures \u002F 2026 \u002F 03 - Mars \u002F 2026-03-15_facture_edf.pdf\n",[37,48,46],{"__ignoreMap":39},[10,50,51,52,55],{},"Vous croisez déjà l'OCR sans le savoir : Google Drive l'applique aux PDF et aux images que vous y déposez, ce qui explique qu'une recherche sur un mot présent ",[14,53,54],{},"dans"," un scan puisse le retrouver. Le dépôt d'un chèque en photo via une application bancaire, c'est aussi de l'OCR.",[19,57,59],{"id":58},"à-quoi-ça-sert-pour-vos-documents","À quoi ça sert pour vos documents",[61,62,63,71,77],"ul",{},[64,65,66,70],"li",{},[67,68,69],"strong",{},"Rechercher dans des scans"," : retrouver « résiliation » dans un courrier numérisé d'il y a deux ans.",[64,72,73,76],{},[67,74,75],{},"Extraire des données"," : date, montant, fournisseur, numéro de contrat.",[64,78,79,82,83,88,89,92],{},[67,80,81],{},"Trier et renommer"," : c'est la donnée extraite par OCR qui permet le ",[84,85,87],"a",{"href":86},"\u002Ffr\u002Fglossary\u002Fclassement-automatique-de-documents","classement automatique de documents"," — sans elle, un logiciel ne peut classer qu'au nom de fichier, généralement inutile (",[37,90,91],{},"IMG_4521.jpg",").",[10,94,95],{},"C'est ce dernier usage qui nous concerne directement : Sorters utilise l'OCR pour lire chaque fichier que vous lui confiez (PDF, JPG, PNG, HEIC…), puis le renomme et le classe dans Google Drive selon vos règles. Le tri est lancé à la demande, fichier par lot choisi — rien ne tourne en arrière-plan.",[19,97,99],{"id":98},"les-limites-à-connaître","Les limites à connaître",[10,101,102],{},"L'OCR n'est pas infaillible, et il vaut mieux le savoir avant de lui confier quoi que ce soit d'important :",[61,104,105,111,117,144],{},[64,106,107,110],{},[67,108,109],{},"L'écriture manuscrite"," reste difficile, surtout cursive. Les moteurs récents progressent, mais une ordonnance griffonnée donnera des résultats inégaux.",[64,112,113,116],{},[67,114,115],{},"La qualité du scan compte"," : photo floue, page de travers, contraste faible ou tampon par-dessus le texte dégradent nettement la reconnaissance.",[64,118,119,122,123,126,127,130,131,126,134,130,137,126,140,143],{},[67,120,121],{},"Les confusions classiques"," persistent sur les documents médiocres : ",[37,124,125],{},"0","\u002F",[37,128,129],{},"O",", ",[37,132,133],{},"1",[37,135,136],{},"l",[37,138,139],{},"5",[37,141,142],{},"S",".",[64,145,146,149],{},[67,147,148],{},"La langue et la mise en page"," : un tableau complexe ou un document multilingue peut être lu dans le désordre.",[10,151,152],{},"En pratique : pour des factures, contrats et courriers imprimés correctement scannés, l'OCR est fiable. Pour des documents critiques (juridiques, comptables), une vérification humaine du résultat reste de mise.",[19,154,156],{"id":155},"pour-aller-plus-loin","Pour aller plus loin",[61,158,159,165],{},[64,160,161,164],{},[84,162,163],{"href":86},"Classement automatique de documents"," — ce que l'OCR rend possible une fois le texte extrait.",[64,166,167,171],{},[84,168,170],{"href":169},"\u002Ffr\u002Fglossary\u002Fnommage-de-fichiers","Conventions de nommage de fichiers"," — donner aux données extraites une forme cohérente et triable.",{"title":39,"searchDepth":173,"depth":173,"links":174},2,[175,176,177,178],{"id":21,"depth":173,"text":22},{"id":58,"depth":173,"text":59},{"id":98,"depth":173,"text":99},{"id":155,"depth":173,"text":156},"Définitions","L'OCR, c'est quoi ? Comment la reconnaissance optique de caractères lit vos documents scannés, ce qu'elle permet dans Google Drive et ses limites.",false,"md",{},true,"\u002Fglossary\u002Focr",{"title":5,"description":180},"glossary\u002Focr","38o9Og8_6n9kaK5hHmq5e0Ulk1fdrg65KGIZ_tZB8m0",1785276345001]