Retour au blog

TECHNOLOGIE & INSPECTION

OCR sur plans cotés : pourquoi les outils génériques échouent sur le manufacturier

En bref

Un plan coté n'est pas une lettre ni un contrat. C'est un objet technique dense : des dimensions, des tolérances, des symboles de tolérancement géométrique, des cadres de référence, le tout dessiné autour d'une pièce et non aligné en lignes de texte. Un OCR généraliste sait lire un paragraphe ; il ne sait pas qu'un « 12,7 » suivi d'un « ±0,05 » forme une cote avec un minimum et un maximum.

Le vrai danger n'est pas qu'un outil mal conçu se trompe bruyamment. C'est qu'il perde des données en silence : une cote sautée, une page tronquée, une valeur non lue — et personne ne le voit avant le donneur d'ordre. Ce qui sépare une extraction fiable d'un gadget, ce n'est pas la puissance du modèle. C'est le logiciel de métier qui l'encadre.


Un plan coté, ce n'est pas du texte

Quand on parle d'« OCR », la plupart des gens imaginent un scanner qui transforme une page en texte modifiable. Une facture, un contrat, un formulaire administratif. Dans ces cas-là, l'information est linéaire : elle se lit de gauche à droite, de haut en bas, et la mise en page aide à la comprendre.

Un dessin technique fonctionne à l'envers. L'information n'est pas alignée : elle gravite autour de la pièce. Une cote est posée là où elle s'applique, souvent en biais, parfois à la verticale, reliée à une arête par une ligne d'attache. Un même dessin mélange des dimensions en millimètres, des fractions impériales, des angles en degrés-minutes-secondes, des ajustements normalisés (un H7, un g6), des cotes unilatérales du type « X MAX ». Et par-dessus tout ça, une grammaire à part entière : le tolérancement géométrique.

Le tolérancement géométrique — le GD&T, dans le jargon — c'est une quinzaine de symboles normalisés (planéité, cylindricité, parallélisme, position, etc.) qui encadrent la géométrie de la pièce au-delà de ses simples dimensions. Pour un machiniste, ces symboles sont aussi importants que les chiffres. Pour un OCR généraliste, ce sont des dessins bizarres qu'il ne cherche même pas à interpréter, parce qu'il n'a jamais été conçu pour ça.

Voilà le premier malentendu. On croit avoir affaire à un problème de lecture. On a en réalité un problème de compréhension métier. Lire « 12,7 ±0,05 » ne sert à rien si l'outil ne sait pas qu'il vient de croiser une cote nominale de 12,7 mm, avec une tolérance symétrique, donc un minimum à 12,65 et un maximum à 12,75. Cette petite arithmétique-là, un dirigeant la fait de tête. Un OCR généraliste ne la fait pas du tout : il n'a aucune idée de ce qu'est une tolérance.

On croit avoir affaire à un problème de lecture. On a en réalité un problème de compréhension métier.

Ce qu'un outil généraliste ne voit pas

Prenons un cas concret. Un atelier d'usinage reconnu de la région de Sorel produit des pièces de précision et doit livrer, avec chaque commande, un rapport d'inspection dimensionnel : la preuve que chaque cote respecte le plan. Avant, un inspecteur relevait manuellement les dizaines de cotes d'un dessin, les recopiait une à une dans un tableur, calculait les min et max à la main, puis reportait les mesures. Un travail minutieux, répétitif, et par nature exposé à l'erreur de recopie.

L'idée d'automatiser la lecture du plan tombe sous le sens. Sauf qu'un outil généraliste, lâché sur ce même dessin, échoue à plusieurs endroits en même temps, et pas là où on l'attend.

Il confond les cotes et les annotations décoratives — un numéro de révision, un cartouche, une note de fabrication. Il aplatit un empilement de tolérances en une seule valeur. Il ignore les symboles GD&T parce qu'il ne les reconnaît pas comme du texte. Il lit « ø » comme un « 0 » ou un « O ». Il perd les cotes penchées, celles qui ne sont pas horizontales. Et surtout, sur un plan dense, il s'arrête : il traite le haut du dessin, où l'information est claire, et laisse tomber le bas, où les cotes se serrent.

Aucune de ces défaillances n'est spectaculaire. Prises une à une, elles paraissent anodines. Mises bout à bout, elles produisent un rapport d'inspection incomplet — et un rapport d'inspection incomplet, dans le manufacturier, ce n'est pas une coquille. C'est un livrable non conforme.

Le vrai danger : la perte silencieuse

Il faut distinguer deux façons pour un logiciel de se tromper. Il y a l'erreur bruyante : l'outil affiche une valeur manifestement absurde, l'inspecteur la voit, la corrige, on passe à autre chose. C'est désagréable, mais c'est sain — le système signale son incertitude, l'humain tranche.

Et il y a l'erreur silencieuse : l'outil ne lit pas une cote, et ne dit rien. Il ne l'affiche pas en rouge, ne la marque pas « à vérifier », ne la compte pas comme manquante. Elle n'existe tout simplement pas dans le tableau. À l'écran, tout a l'air complet. C'est ce type de défaillance qui coûte cher, parce qu'il est invisible jusqu'au moment où quelqu'un d'autre — le donneur d'ordre, l'auditeur — le découvre à votre place.

J'ai vu ce mécanisme de près. Dans une version antérieure d'un outil d'extraction que je développais, un plafond technique limitait le nombre de lignes traitées. Sur un rapport court, on ne voyait rien. Mais un scan de douze pages, avec des centaines de cotes, dépassait ce plafond — et ressortait avec zéro valeur. Pas une erreur. Pas un avertissement. Un tableau vide, poliment. L'outil « fonctionnait » ; il perdait simplement tout, sans le dire.

La leçon m'a marqué, parce qu'elle est contre-intuitive. On surveille toujours les erreurs qu'on voit. Ce sont celles qu'on ne voit pas qui font échouer une inspection. Un logiciel de métier bien conçu se juge d'abord là-dessus : sa capacité à ne jamais perdre une donnée en silence.

Pourquoi le cadre logiciel change tout

Ici, il faut dire une chose franchement, parce qu'elle va à contre-courant du discours ambiant : le modèle d'intelligence artificielle qui « lit » le plan n'est pas le héros de l'histoire. Le même modèle, seul, produit exactement les défaillances décrites plus haut. Ce qui le rend fiable, c'est tout ce qu'on construit autour de lui.

Concrètement, un logiciel de métier bien pensé fait au moins trois choses que l'IA seule ne fait pas.

Il découpe le travail pour ne rien laisser tomber. Plutôt que de demander à l'IA d'avaler une page dense d'un coup — moment où elle « décroche » et abandonne le bas —, on découpe chaque page en bandes, on traite chaque bande, puis on recompose. La cote du coin inférieur droit a autant de chances d'être lue que celle du haut. C'est une décision d'ingénierie, pas une capacité du modèle. Ce découpage compte double sur les grands formats : un plan livré en format D ou E, ou un dossier de plusieurs pages, arrive souvent en scan de très haute résolution. Réduit pour tenir d'un bloc, un tel plan devient illisible — les petits chiffres se brouillent, les cotes serrées se fondent. Traité par bandes, à pleine résolution, page après page, chaque zone garde sa netteté et rien n'est sacrifié pour faire entrer le dessin entier dans une seule lecture.

Il relie la lecture au métier par des règles déterministes. Une fois la cote lue, ce n'est pas l'IA qui devine à quelle ligne du rapport elle correspond, ni qui invente ses min et max. C'est du code strict, prévisible, vérifiable : le parsing des tolérances, le calcul des seuils, la reconnaissance des symboles GD&T normalisés. On laisse l'IA faire ce qu'elle fait le mieux — reconnaître ce qui est écrit — et on confie le reste à des règles qu'on peut auditer. On ne laisse jamais l'IA « deviner » ce qu'un calcul exact peut établir.

Il rend l'incertitude visible. Quand la lecture d'une valeur est douteuse, un bon outil ne la fait pas passer pour certaine. Il la surligne, la met à l'écart, force une relecture humaine. L'incertitude devient une information affichée, pas un risque enfoui. C'est exactement l'inverse de la perte silencieuse.

La différence entre un OCR généraliste et une extraction spécialisée, ce n'est donc pas « un meilleur cerveau ». C'est un cerveau encadré. Sans ce cadre, l'IA est un décor convaincant qui s'effondre au premier plan complexe. Avec lui, elle abat la part répétitive du travail — lire, transcrire, calculer — et laisse à l'humain la part qui lui revient : juger, mesurer, signer.

Le modèle d'IA n'est pas le héros de l'histoire. Ce qui le rend fiable, c'est tout ce qu'on construit autour de lui.

Ce que ça change pour la libération des produits

On pourrait croire que tout ceci reste une affaire de technique interne. Ce serait une erreur, parce que la fiabilité de l'extraction touche directement une obligation de la norme.

L'ISO 9001 encadre la libération des produits et services à son article §8.6 : on ne libère une pièce vers le client qu'après avoir vérifié que les critères sont satisfaits, et en conservant les preuves de cette vérification. Le rapport d'inspection dimensionnel est cette preuve. C'est lui qui atteste que chaque cote a été contrôlée et jugée conforme.

Or que se passe-t-il si l'outil qui produit ce rapport perd des cotes en silence ? La preuve ment sans qu'on le sache. Le tableau est complet en apparence, il ne l'est pas en réalité, et on libère une pièce sur la foi d'une vérification incomplète. Le problème n'est plus technique : il est au cœur de la conformité. Un outil d'extraction n'est pas qu'un gain de temps pour l'inspecteur — c'est un maillon de la chaîne de preuve qui autorise la livraison.

C'est pour ça que je juge un logiciel d'extraction sur sa rigueur avant de le juger sur sa vitesse. Un outil rapide qui perd des données discrètement est plus dangereux qu'un tableur bien tenu à la main. Et soyons honnêtes : aucun outil ne lit parfaitement tous les plans. Un dessin taché, plissé, scanné de travers ou de mauvaise qualité mettra n'importe quel modèle en difficulté — la vision automatique a ses limites, et prétendre le contraire serait mentir. La fiabilité ne vient donc pas d'une lecture parfaite à cent pour cent : elle vient de la capacité de l'outil à signaler ce dont il n'est pas sûr, plutôt que de le faire passer pour lu.

Les bonnes questions à poser à un outil

Vous n'avez pas besoin d'être ingénieur logiciel pour évaluer un outil d'extraction de plans. Il suffit de poser les bonnes questions — celles qui séparent un vrai outil de métier d'un OCR habillé pour l'occasion.

La question à poserCe qu'une bonne réponse révèle
Comment savez-vous qu'aucune cote n'a été oubliée ?L'outil compte-t-il ce qu'il n'a pas su lire, ou fait-il disparaître le manquant ?
Que faites-vous d'une valeur douteuse ?L'incertitude est-elle affichée, ou noyée dans le lot ?
Lisez-vous les symboles de tolérancement géométrique ?L'outil comprend-il le langage du plan, ou seulement ses chiffres ?
Que se passe-t-il sur un plan très dense, sur plusieurs pages ?Y a-t-il un plafond invisible qui fait décrocher l'outil ?
Qui calcule les tolérances : le modèle ou une règle vérifiable ?Le métier repose-t-il sur une devinette ou sur du code auditable ?

Si les réponses restent vagues, méfiez-vous. Un fournisseur qui vante la puissance de son IA sans jamais parler de ce qui l'encadre vous vend le décor, pas la structure. Et dans le manufacturier, c'est la structure qui tient debout à l'audit.


En conclusion : qui vérifie que rien n'a été perdu ?

Un plan coté est l'un des documents les plus riches et les plus exigeants qu'un atelier manipule. Le lire à moitié, c'est pire que ne pas le lire du tout, parce qu'un demi-rapport a l'air d'un rapport complet. C'est précisément ce piège que les outils génériques ne savent pas éviter : ils sont excellents pour la prose, désarmés devant la géométrie, et dangereux quand ils échouent sans le dire.

La vraie question n'est donc pas « quelle IA lit le mieux un plan ». C'est : quel logiciel rend visible ce qu'il a manqué ou mal lu plutôt que de le cacher, surligne ce dont il n'est pas sûr, et laisse l'humain juger et signer ce que la machine a préparé ? Une extraction spécialisée n'est pas un OCR plus intelligent. C'est un OCR mis au service d'une discipline de métier.

Reste une question ouverte, que je me pose encore à chaque nouveau type de plan : jusqu'où peut-on faire confiance à une lecture automatique avant que la vérification humaine ne redevienne, elle aussi, une simple formalité qu'on finit par sauter ? La réponse, je crois, tient dans le mot « encadré ». Retirez le cadre, et la confiance devient un pari. Gardez-le, et elle devient une preuve.

Les principes décrits dans cet article sont ceux qui ont guidé le développement d'Asterion Solutions, une suite de logiciels de métier pensés pour les PME manufacturières qui veulent structurer leur qualité sans multiplier les tâches administratives.

Ressource gratuite

Modèle de rapport d'inspection conforme ISO 9001

Le gabarit prêt à l'emploi : en-tête, tableau des cotes, libération — et les erreurs qui coûtent cher.