Kurz gesagt
Eine bemaßte Zeichnung ist weder ein Brief noch ein Vertrag. Sie ist ein dichtes technisches Objekt: Maße, Toleranzen, Symbole der Form- und Lagetolerierung, Bezugssysteme, alles um ein Teil herum gezeichnet und nicht in Textzeilen angeordnet. Eine allgemeine Texterkennung kann einen Absatz lesen; sie weiß nicht, dass eine „12,7“ gefolgt von „±0,05“ ein Maß mit Mindest- und Höchstwert bildet.
Die eigentliche Gefahr ist nicht, dass ein schlecht konzipiertes Werkzeug sich lautstark irrt. Sondern dass es Daten stillschweigend verliert: ein übersprungenes Maß, eine abgeschnittene Seite, ein nicht gelesener Wert, und niemand bemerkt es vor dem Auftraggeber. Was eine verlässliche Erkennung von einer Spielerei trennt, ist die Fachsoftware, die dem Modell den Rahmen setzt.
Eine bemaßte Zeichnung ist kein Text
Wenn von „OCR“ die Rede ist, stellen sich die meisten einen Scanner vor, der eine Seite in bearbeitbaren Text verwandelt. Eine Rechnung, einen Vertrag, ein Verwaltungsformular. In diesen Fällen ist die Information linear: Man liest sie von links nach rechts, von oben nach unten, und das Layout hilft beim Verstehen.
Eine technische Zeichnung funktioniert umgekehrt. Die Information ist nicht ausgerichtet: Sie kreist um das Teil. Ein Maß steht dort, wo es gilt, oft schräg, manchmal senkrecht, mit einer Maßhilfslinie an eine Kante gebunden. Ein und dieselbe Zeichnung mischt Maße in Millimetern, Bruchmaße in Zoll, Winkel in Grad-Minuten-Sekunden, genormte Passungen (ein H7, ein g6), einseitige Maße vom Typ „X MAX“. Und darüber eine eigene Grammatik: die Form- und Lagetolerierung.
Die Form- und Lagetolerierung (GD&T im Fachjargon) besteht aus rund fünfzehn genormten Symbolen (Ebenheit, Zylinderform, Parallelität, Position usw.), die die Geometrie des Teils über seine bloßen Maße hinaus festlegen. Für einen Zerspaner sind diese Symbole so wichtig wie die Zahlen. Für eine allgemeine Texterkennung sind es seltsame Kritzeleien, die sie gar nicht erst zu deuten versucht, weil sie nie dafür gebaut wurde.
Das ist das erste Missverständnis. Man glaubt, es mit einem Leseproblem zu tun zu haben. In Wirklichkeit hat man ein Problem des fachlichen Verstehens. „12,7 ±0,05“ zu lesen nützt nichts, wenn das Werkzeug nicht weiß, dass es gerade auf ein Nennmaß von 12,7 mm mit symmetrischer Toleranz gestoßen ist, also auf ein Minimum von 12,65 und ein Maximum von 12,75. Diese kleine Rechnung macht ein Geschäftsführer im Kopf. Eine allgemeine Texterkennung macht sie gar nicht: Sie hat keine Ahnung, was eine Toleranz ist.
Man glaubt, es mit einem Leseproblem zu tun zu haben. In Wirklichkeit hat man ein Problem des fachlichen Verstehens.
Was ein allgemeines Werkzeug nicht sieht
Nehmen wir einen konkreten Fall. Ein anerkannter Zerspanungsbetrieb in der Region Sorel in Québec fertigt Präzisionsteile und muss mit jedem Auftrag einen Maßprüfbericht liefern: den Nachweis, dass jedes Maß der Zeichnung entspricht. Früher erfasste ein Prüfer die Dutzende von Maßen einer Zeichnung von Hand, schrieb sie einzeln in eine Tabelle ab, berechnete Mindest- und Höchstwerte von Hand und trug dann die Messwerte ein. Eine sorgfältige, sich wiederholende und naturgemäß fehleranfällige Arbeit.
Die Idee, das Lesen der Zeichnung zu automatisieren, liegt auf der Hand. Nur scheitert ein allgemeines Werkzeug, auf dieselbe Zeichnung losgelassen, an mehreren Stellen gleichzeitig, und nicht dort, wo man es erwartet.
Es verwechselt Maße mit Nebenangaben: einer Revisionsnummer, einem Schriftfeld, einem Fertigungshinweis. Es fasst übereinandergeschriebene Toleranzen zu einem einzigen Wert zusammen. Es ignoriert die GD&T-Symbole, weil es sie nicht als Text erkennt. Es liest „ø“ als „0“ oder „O“. Es verliert schräge Maße, alle, die nicht waagerecht stehen. Und vor allem hört es bei einer dichten Zeichnung auf: Es verarbeitet den oberen Teil, wo die Information klar ist, und lässt den unteren fallen, wo sich die Maße drängen.
Keiner dieser Ausfälle ist spektakulär. Einzeln wirken sie harmlos. Aneinandergereiht ergeben sie einen unvollständigen Prüfbericht. Und ein unvollständiger Prüfbericht ist in der Fertigung kein Tippfehler: Er ist ein nicht konformer Liefergegenstand.
Die eigentliche Gefahr: der stille Verlust
Man muss zwei Arten unterscheiden, wie sich eine Software irren kann. Da ist der laute Fehler: Das Werkzeug zeigt einen offensichtlich absurden Wert, der Prüfer sieht ihn, korrigiert ihn, man macht weiter. Das ist unangenehm, aber gesund: Das System meldet seine Unsicherheit, der Mensch entscheidet.
Und da ist der stille Fehler: Das Werkzeug liest ein Maß nicht und sagt nichts. Es zeigt es nicht rot an, markiert es nicht „zu prüfen“, zählt es nicht als fehlend. Es existiert schlicht nicht in der Tabelle. Am Bildschirm sieht alles vollständig aus. Genau diese Art von Ausfall ist teuer, weil sie unsichtbar bleibt, bis jemand anderes (der Auftraggeber, der Auditor) sie an Ihrer Stelle entdeckt.
Ich habe diesen Mechanismus aus der Nähe gesehen. In einer früheren Version eines Erkennungswerkzeugs, das ich entwickelte, begrenzte eine technische Obergrenze die Zahl der verarbeiteten Zeilen. Bei einem kurzen Bericht sah man nichts. Aber ein zwölfseitiger Scan mit Hunderten von Maßen überschritt diese Grenze und kam mit null Werten heraus. Kein Fehler. Keine Warnung. Eine leere Tabelle, höflich. Das Werkzeug „funktionierte“; es verlor einfach alles, ohne es zu sagen.
Die Lehre hat mich geprägt, weil sie der Intuition widerspricht. Man überwacht immer die Fehler, die man sieht. Es sind die unsichtbaren, an denen eine Prüfung scheitert. Eine gut konzipierte Fachsoftware misst sich zuerst daran: an ihrer Fähigkeit, nie stillschweigend eine Information zu verlieren.
Warum der Software-Rahmen alles ändert
Hier muss man etwas offen sagen, weil es dem gängigen Diskurs widerspricht: Das KI-Modell, das die Zeichnung „liest“, ist nicht der Held der Geschichte. Dasselbe Modell erzeugt allein genau die oben beschriebenen Ausfälle. Verlässlich wird es durch alles, was man um es herum baut.
Konkret macht eine gut durchdachte Fachsoftware mindestens drei Dinge, die die KI allein nicht macht.
Sie teilt die Arbeit auf, damit nichts verloren geht. Statt die KI eine dichte Seite auf einmal schlucken zu lassen (der Moment, in dem sie „abschaltet“ und den unteren Teil aufgibt), teilt man jede Seite in Streifen, verarbeitet jeden Streifen und setzt dann zusammen. Das Maß in der unteren rechten Ecke hat dieselbe Chance, gelesen zu werden, wie das oben. Das ist eine technische Entscheidung, keine Fähigkeit des Modells. Diese Aufteilung zählt doppelt bei großen Formaten: Eine Zeichnung in A1 oder A0, oder eine mehrseitige Mappe, kommt oft als Scan in sehr hoher Auflösung. Verkleinert, damit sie am Stück verarbeitet werden kann, wird so eine Zeichnung unlesbar: Kleine Ziffern verschwimmen, eng gesetzte Maße fließen ineinander. Streifenweise verarbeitet, in voller Auflösung, Seite für Seite, behält jeder Bereich seine Schärfe, und nichts wird geopfert, um die ganze Zeichnung in einen einzigen Lesedurchgang zu zwängen.
Sie verbindet das Lesen mit dem Fach durch deterministische Regeln. Ist das Maß gelesen, rät nicht die KI, zu welcher Berichtszeile es gehört, und sie erfindet auch nicht seine Grenzwerte. Das macht strenger, vorhersehbarer, überprüfbarer Code: das Auswerten der Toleranzen, die Berechnung der Grenzen, das Erkennen genormter GD&T-Symbole. Man lässt die KI tun, was sie am besten kann (erkennen, was geschrieben steht), und überlässt den Rest Regeln, die man prüfen kann. Man lässt die KI nie „raten“, was eine exakte Rechnung festlegen kann.
Sie macht Unsicherheit sichtbar. Ist das Lesen eines Werts zweifelhaft, gibt ein gutes Werkzeug ihn nicht als sicher aus. Es hebt ihn hervor, stellt ihn zurück, erzwingt eine menschliche Prüfung. Die Unsicherheit wird zur angezeigten Information, nicht zum vergrabenen Risiko. Das ist genau das Gegenteil des stillen Verlusts.
Der Unterschied zwischen einer allgemeinen Texterkennung und einer spezialisierten Erkennung ist also kein „besseres Gehirn“. Es ist ein eingehegtes Gehirn. Ohne diesen Rahmen ist die KI eine überzeugende Kulisse, die bei der ersten komplexen Zeichnung einstürzt. Mit ihm erledigt sie den sich wiederholenden Teil der Arbeit (lesen, übertragen, rechnen) und überlässt dem Menschen den Teil, der ihm zusteht: beurteilen, messen, unterschreiben.
Das KI-Modell ist nicht der Held der Geschichte. Verlässlich wird es durch alles, was man um es herum baut.
Was das für die Freigabe von Produkten ändert
Man könnte meinen, all das sei eine rein interne technische Angelegenheit. Das wäre ein Irrtum, denn die Verlässlichkeit der Erkennung berührt direkt eine Pflicht aus der Norm.
ISO 9001 regelt die Freigabe von Produkten und Dienstleistungen in §8.6: Ein Teil wird erst an den Kunden freigegeben, nachdem überprüft wurde, dass die Kriterien erfüllt sind, und die Nachweise dieser Prüfung werden aufbewahrt. Der Maßprüfbericht ist dieser Nachweis. Er bestätigt, dass jedes Maß geprüft und als konform beurteilt wurde.
Was aber, wenn das Werkzeug, das diesen Bericht erzeugt, stillschweigend Maße verliert? Dann lügt der Nachweis, ohne dass man es weiß. Die Tabelle wirkt vollständig, ist es aber nicht, und man gibt ein Teil auf Grundlage einer unvollständigen Prüfung frei. Das Problem ist nicht mehr technisch: Es liegt im Kern der Konformität. Ein Erkennungswerkzeug ist mehr als eine Zeitersparnis für den Prüfer: Es ist ein Glied der Nachweiskette, die die Lieferung freigibt.
Deshalb beurteile ich eine Erkennungssoftware zuerst nach ihrer Gründlichkeit und erst dann nach ihrer Geschwindigkeit. Ein schnelles Werkzeug, das heimlich Daten verliert, ist gefährlicher als eine sorgfältig von Hand geführte Tabelle. Und seien wir ehrlich: Kein Werkzeug liest alle Zeichnungen perfekt. Eine fleckige, zerknitterte, schief gescannte oder schlechte Zeichnung bringt jedes Modell in Schwierigkeiten. Maschinelles Sehen hat Grenzen, und das Gegenteil zu behaupten wäre gelogen. Verlässlichkeit kommt also nicht von einer hundertprozentig fehlerfreien Erkennung: Sie kommt von der Fähigkeit des Werkzeugs, zu melden, wessen es sich nicht sicher ist, statt es als gelesen auszugeben.
Die richtigen Fragen an ein Werkzeug
Sie müssen kein Softwareingenieur sein, um ein Werkzeug zur Zeichnungserkennung zu beurteilen. Es genügt, die richtigen Fragen zu stellen, die eine echte Fachsoftware von einer bloß aufgehübschten Texterkennung unterscheiden.
| Die Frage | Was eine gute Antwort verrät |
|---|---|
| Woher wissen Sie, dass kein Maß vergessen wurde? | Zählt das Werkzeug, was es nicht lesen konnte, oder lässt es das Fehlende verschwinden? |
| Was machen Sie mit einem zweifelhaften Wert? | Wird die Unsicherheit angezeigt oder in der Menge versteckt? |
| Lesen Sie die Symbole der Form- und Lagetolerierung? | Versteht das Werkzeug die Sprache der Zeichnung oder nur ihre Zahlen? |
| Was passiert bei einer sehr dichten, mehrseitigen Zeichnung? | Gibt es eine unsichtbare Grenze, bei der das Werkzeug abschaltet? |
| Wer berechnet die Toleranzen: das Modell oder eine überprüfbare Regel? | Beruht das Fachliche auf Raten oder auf prüfbarem Code? |
Bleiben die Antworten vage, seien Sie misstrauisch. Ein Anbieter, der die Leistung seiner KI lobt, ohne je über das zu sprechen, was ihr den Rahmen setzt, verkauft Ihnen die Kulisse, nicht die Struktur. Und in der Fertigung ist es die Struktur, die im Audit standhält.
Zum Schluss: Wer prüft, dass nichts verloren ging?
Eine bemaßte Zeichnung ist eines der reichsten und anspruchsvollsten Dokumente, mit denen ein Betrieb umgeht. Sie zur Hälfte zu lesen ist schlimmer, als sie gar nicht zu lesen, weil ein halber Bericht wie ein vollständiger aussieht. Genau diese Falle können allgemeine Werkzeuge nicht vermeiden: hervorragend bei Fließtext, hilflos vor der Geometrie und gefährlich, wenn sie scheitern, ohne es zu sagen.
Die eigentliche Frage lautet also nicht „welche KI liest eine Zeichnung am besten“. Sondern: Welche Software macht sichtbar, was sie übersehen oder falsch gelesen hat, statt es zu verstecken, hebt hervor, wessen sie sich nicht sicher ist, und lässt den Menschen beurteilen und unterschreiben, was die Maschine vorbereitet hat? Eine spezialisierte Erkennung ist eine Texterkennung im Dienst einer fachlichen Disziplin.
Bleibt eine offene Frage, die ich mir bei jeder neuen Zeichnungsart noch stelle: Wie weit kann man einer automatischen Erkennung vertrauen, bevor die menschliche Prüfung selbst zu einer bloßen Formalität wird, die man irgendwann überspringt? Die Antwort liegt, glaube ich, im Wort „Rahmen“. Nehmen Sie den Rahmen weg, und Vertrauen wird zur Wette. Behalten Sie ihn, und es wird zum Nachweis.
Die in diesem Artikel beschriebenen Grundsätze haben die Entwicklung von Asterion Solutions geleitet, einer Suite von Fachsoftware für Fertigungs-KMU, die ihre Qualität strukturieren wollen, ohne den Verwaltungsaufwand zu vervielfachen.