KI unter menschlicher Kontrolle und Aufsicht

Abbildung 1
Abbildung 1Bild: Gramelt, Höfer und Schmid (2024)

Methoden der Erklärbaren KI (XAI) ermöglichen es, nachvollziehbar zu machen, auf welcher Informationsgrundlage ein KI-System zu einer bestimmten Ausgabe gekommen ist. Dadurch kann Vertrauen sinnvoll kalibriert werden. In Kombination mit Methoden des interaktiven maschinellen Lernens können Erklärungen dabei unterstützen, KI-Systeme durch gezielte Rückmeldungen zu verbessern. Interaktive XAI-Systeme liefern damit eine technologische Grundlage für menschliche Kontrolle und Aufsicht von KI-Systemen.

Domänenfachleute und Endnutzende sind Teil des maschinellen Lernprozess. Ihnen werden die Modellvorhersagen und Klassifikationen nachvollziehbar erklärt und sie haben ihrerseits die Möglichkeit, korrigierend in den Lernprozess einzugreifen, etwa auf Modell- oder auf Datensatzebene (Schmid 2024). Auf diese Weise können durch die XAI-Komponente eines KI-Systems fehlerhafte Systemausgaben und Biases aufgedeckt werden. Durch die interaktive Komponente kann das Modell eines KI-Systems oder auch ein nachvollziehbares, regelbasiertes Ersatzmodell (sogenannt Surrogat-Modell), das ein ursprüngliches Black-Box-Modell approximiert, korrigiert und verbessert werden – beispielsweise indem ein Trainingsdatensatz, eine Verlustkurve oder Regelsätze angepasst werden (engl. explain to revise).

Die Potenziale von XAI

Anwendungsnahe Studien zeigen, dass beispielsweise Modelle zur Krebserkennung oder zur Anomalieerkennung in der industriellen Qualitätskontrolle mit interaktiver XAI verbessert werden können (Plattform Lernende System 2023, Gramelt, Höfer & Schmid 2024). Es konnte zudem demonstriert werden, dass durch interaktive XAI die Vorhersage- und Erklärungskraft von KI-Modellen erhöht und damit mehr Vertrauen bzw. begründetes Misstrauen in KI-Systeme aufgebaut werden kann (Teso und Kersting 2019, Gramelt, Höfer & Schmid 2024). Darüber hinaus spielt interaktive XAI unter anderem bei der Kontrolle von Systemen mit höheren Autonomiegraden und bei der Anpassung von KI-Systemen an Domänen und Individuen eine wichtige Rolle.

Nutzende wie Domänenexpertinnen und -experten werden das Verhalten des Modells mit ihrer Intuition oder ihrem Erfahrungswissen abgleichen, sodass Diskrepanzen zwischen dem KI-Modell und den Domänenspezifika erkannt und reduziert werden können (vgl. Bhatt et al. 2020, S.650). Interaktive XAI-Methoden können hier unterstützen, indem sie beispielsweise Domänenexpertinnen und -experten den Abgleich mit dem Erfahrungswissen durch eine Erklärung erleichtern und diese so wiederum präziseres Feedback für die Anpassung des KI-Systems geben können. Ein geeignetes User-Experience-Design kann Nutzende unterstützen, wenn durch Interaktivität im Dialog mit dem KI-System verschiedene Ebenen und Formen der Erläuterung abgerufen werden können (Finzel et al. 2021).

Wo die Herausforderungen liegen

In der praktischen Umsetzung und Anwendung von interaktiver XAI zeigen sich jedoch verschiedene Herausforderungen, die Potenziale für weitere Forschung und Entwicklung liefern. Eine Meta-Studie zeigt etwa, dass aktuell Mensch-KI-Teams in den meisten Fällen eine schlechtere Performanz liefern, als das beste KI-Modell oder der beste Mensch alleine (Vaccaro, Almaatouq, & Malon, 2024). Gründe dafür liegen zum Teil an unzureichender Passung zwischen menschlicher und maschineller Informationsverarbeitung:

  • Eine zielgerichtete Interaktion mit KI-Systemen basiert darauf, dass Menschen verstehen können, warum das System zu einer bestimmten Ausgabe kommt. Die Kommunikation zwischen Menschen findet meist auf der Basis von abstrakten, aber aussagekräftigen Konzepten statt. Wie KI-Systeme dazu befähigt werden können, auf Basis von Konzepten zu kommunizieren, ist Gegenstand der Forschung zu konzept-basierter XAI (Finzel et al., 2025).
  • Wenn Nutzende in der Interaktion korrigierende oder annotierende Informationen an das KI-System weitergeben, kann dies ‚Rauschen‘ durch ungenaues Feedback oder Flüchtigkeitsfehler in den Lernprozess einführen und zu erhöhtem Aufwand und Kosten auf Seiten der Nutzenden führen.
  • Menschliche Urteile sind teilweise durch subjektive Biases gefärbt. Gerade in Grenzbereichen, etwa ob ein Werkstück Ausschuss ist oder nicht, können verschiedene Personen zu unterschiedlichen Einschätzungen kommen. Entsprechend kann interaktives Feedback Inkonsistenzen bei der Modellanpassung erzeugen.
  • Erklärungen sollen prinzipiell eine Grundlage für Vertrauen von Nutzenden in KI-Systeme schaffen. Allerdings können Erklärungen, selbst wenn sie fehlerhaft sind, zu unberechtigtem Übervertrauen oder umgekehrt, wenn sie nicht verständlich sind, zu unberechtigtem Misstrauen gegenüber dem System führen (Schmid, 2024).
Abbildung 2
Abbildung 2Bild: Acatech – Dt. Akademie der Technikwissenschaften

Auch bezüglich der XAI-Methodik bestehen aktuell noch offene Fragen. So kann die mangelnde Modelltreue einer Erklärung zu einem Problem in der Interaktion werden – etwa wenn die Erklärung den Nutzenden ungenaue oder falsche Information darüber gibt, welche Information aus einer Eingabe (z.B. einem Bild) ein gelerntes Modell vor allem genutzt hat, um zu seiner Ausgabe zu kommen und dieser ein entsprechendes Feedback an das System gibt. Und während es für die Evaluation von Methoden des maschinellen Lernens standardisierte Metriken und Benchmarks gibt, gibt es aktuell noch keine bewährte Methodik zur Evaluierung von erklärbarer interaktiver XAI.

Ein typischer Anwendungsfall

Ein typischer Anwendungsfall für die Erkennung von Anomalien in der Industrie ist die Qualitätssicherung in der Produktionslinie – im Beispiel geht es um die industrieller Scheiben. Um den Prozess der Erkennung von Defekten zu beschleunigen, ist es hilfreich, Endnutzenden eine Begründung für die Klassifizierungsentscheidung zu geben. Dies kann im Falle von Bildern durch die Hervorhebung der für die Anomalieerkennung verantwortlichen Pixel geschehen (siehe Abbildung 2).

Wie der Ablauf von interaktiver XAI im Sinne von ‚explain to revise‘ aussehen könnte, zeigt sich ebenfalls anhand dieses Beispiels. Zunächst wird nach Abschluss des KI-Trainings das gelernte Klassifizierungsmodell auf neuen Daten eingesetzt. Nutzenden werden Bilder mit hoher Unsicherheit über eine Schnittstelle angezeigt, inklusive der vorhergesagten Klasse (z.B. Defekt/Nicht-Defekt) und einer Erklärung der Vorhersage (Abbildung 2 a und b). Nutzende können dann die Vorhersage und die Erklärung bewerten. Dies ist wichtig, da es hier zu einer richtigen Klassifizierung aus falschen Gründen kommen kann. Dies ist in Abbildung 2 der Fall und gibt Hinweise für mögliche Korrekturen.

Nachdem die Nutzenden die Erklärung und die Vorhersage überprüft und gegebenenfalls korrigiert haben, werden auf Basis der Korrekturen neue Trainingsdaten erzeugt (Abbildung 2 c und b). Danach werden die Bilder mit den Korrekturen dem Trainingsdatensatz hinzugefügt. Unter Verwendung des erweiterten Trainingsdatensatzes kann das Modell neu trainiert oder angepasst werden, und seine Leistung verbessern. Diese Schleife wird so lange wiederholt, bis eine bestimmte Leistung des KI-Systems erreicht wurde. Alternativ zu Erklärungen über Hervorhebungen im Bild können diese in Form von Beispielen gegeben werden, die der aktuellen Eingabe ähnlich sind und die vom Modell zur gleichen (near hit) oder einer anderen (near miss) Klasse zugeordnet werden. Solche beispielbasierten Erklärungen sind hilfreich, um die Entscheidungsgrenzen des gelernten Modells besser nachzuvollziehen (siehe Abbildung 1).

KI unter Aufsicht

AG1 UteSchmid copyright J Schabel 6
Bild: Acatech – Dt. Akademie der Technikwissenschaften

In Zukunft werden Mensch und KI verstärkt zusammenarbeiten. Menschliche Kontrolle und Aufsicht werden damit weiterhin an Bedeutung gewinnen und eine zentrale Anforderung an vertrauenswürdige KI-Systeme darstellen. KI-Systeme, die Prozesse im Sinne eines ‚explain to revise‘ ermöglichen und dabei KI-Modelle inkrementell verbessern, sind ein möglicher Lösungsansatz für diese Anforderung. Künftig werden aber auch neue, interaktive Ansätze zur Mensch-KI-Kommunikation nötig sein, für die neue Formen der bidirektionalen Erklärbarkeit erforscht werden müssen.



  • Auftragseingang anhaltend schwach

    Auftragseingang anhaltend schwach

    Der Branchenverband VDMA hat im Juli bei seinen Mitgliedern erneut einen schwachen Auftragseingang ermittelt. Der Monatswert fiel bei den Maschinen- und Anlagenbauern real um elf Prozent niedriger als im Vorjahr…

    mehr lesen: Auftragseingang anhaltend schwach

  • KI-basierte Datenverarbeitung im autonomen Fahrzeug

    KI-basierte Datenverarbeitung im autonomen Fahrzeug

    Forschung an neuromorpher Hardware im Projekt KI-Flex KI-basierte Datenverarbeitung im autonomen Fahrzeug Im Forschungsprojekt KI-Flex wurde an einer Plattform gearbeitet, die im autonomen Fahrzeug alle Verkehrsteilnehmer sicher orten soll. Entstanden…

    mehr lesen: KI-basierte Datenverarbeitung im autonomen Fahrzeug

  • Nachhaltigkeit entlang der gesamten Wertschöpfungskette

    Nachhaltigkeit entlang der gesamten Wertschöpfungskette

    Nachhaltigkeit und Wirtschaftlichkeit für den Industriesektor Hand in Hand? Dies kann Realität werden. Das kürzlich abgeschlossene Forschungsprojekt ’Climate Solution for Industries’ (CS4I) unter Beteiligung des Fraunhofer IPA setzt bereits bei…

    mehr lesen: Nachhaltigkeit entlang der gesamten Wertschöpfungskette

  • Anzeige
    Retarus beschleunigt Datenaustausch in der Produktion

    Retarus beschleunigt Datenaustausch in der Produktion

    Die Digitalisierungs- und Automatisierungslösungen von Retarus ermöglichen effiziente Abläufe ohne manuellen Aufwand oder Kompromisse bei der Datensouveränität

    mehr lesen: Retarus beschleunigt Datenaustausch in der Produktion

  • Neil Barua folgt auf James Heppelmann

    Neil Barua folgt auf James Heppelmann

    Nach 13 Jahren als CEO beim Softwareunternehmen PTC verabschiedet sich James Heppelmann in den Ruhestand. Sein Nachfolger wird Neil Barua.

    mehr lesen: Neil Barua folgt auf James Heppelmann

  • Skeptischer Blick auf den Sommer

    Skeptischer Blick auf den Sommer

    Ifo Geschäftsklimaindex im Mai Skeptischer Blick auf den Sommer Nach 93,4 Punkten im Vormonat, fällt der Ifo Geschäftsklimaindex im Mai auf 91,7 Punkte – der erste Rückgang in sechs Montanen.

    mehr lesen: Skeptischer Blick auf den Sommer

  • Kritik am Cyber Resilience Act

    Kritik am Cyber Resilience Act

    Kritik am Cyber Resilience Act Open-Source-Organisationen richten offenen Brief an EU Kommission In einem offenen Brief kritisieren neun Open-Source-Organisationen die EU Kommission, die Perspektive der Community im Rahmen des Cyber…

    mehr lesen: Kritik am Cyber Resilience Act

  • VDI bietet Big-Data-Schulungen an

    VDI bietet Big-Data-Schulungen an

    Aus- und Weiterbildung VDI bietet Big-Data-Schulungen an Auf Grundlage der im November 2022 veröffentlichten Richtlinie VDI/VDE-MT 3714 bietet der VDI Schulungen für die Implementierung und den Betrieb von Big-Data-Anwendungen an.

    mehr lesen: VDI bietet Big-Data-Schulungen an

  • Qualitätsmanagement-System mit integrierter KI

    Qualitätsmanagement-System mit integrierter KI

    KI-Funktionen in Standardsoftware Qualitätsmanagement-System mit integrierter KI Softwareanbieter Consense ergänzt sein Qualitätsmanagement-System um KI-gestützte Funktionen. Die Algorithmen sollen helfen, Prozesse zu automatisieren und einfacher zu gestalten.

    mehr lesen: Qualitätsmanagement-System mit integrierter KI

  • Eine Tauschplattform für die Autoindustrie

    Eine Tauschplattform für die Autoindustrie

    Plattform Wavetrade Eine Tauschplattform für die Autoindustrie Der KI-Spezialist One Data hat eine Tauschplattform an den Start gebracht, über die Automobilhersteller ’kritische Komponenten’ wie etwa Halbleiter an- und verkaufen sowie…

    mehr lesen: Eine Tauschplattform für die Autoindustrie

  • Marktstudie vergleicht mehr als 140 SCM-Lösungen

    Marktstudie vergleicht mehr als 140 SCM-Lösungen

    Supply-Chain-Management-Software Marktstudie vergleicht mehr als 140 SCM-Lösungen Wo liegen die Unterschiede in Supply-Chain-Management-Software? Eine Marktübersicht der Trovarit, des Fraunhofer IPA und des IFR vergleicht mehr als 140 Lösungen.

    mehr lesen: Marktstudie vergleicht mehr als 140 SCM-Lösungen

  • Was bedeuten Low Code und No Code für ERP-Systeme?

    Was bedeuten Low Code und No Code für ERP-Systeme?

    Diskussionspapier des Bitkom Was bedeuten Low Code und No Code für ERP-Systeme? Mit Low Code bzw. No Code können auch Nicht-ITler Anwendungen aus vorgefertigten Bausteinen erstellen. Die Auswirkungen des Ansatzes…

    mehr lesen: Was bedeuten Low Code und No Code für ERP-Systeme?