Alles, was du über Erklärbare KI (XAI) wissen musst
Entdecke, wie Erklärbare KI (XAI) Vertrauen schafft, indem sie KI-Vorhersagen in Bereichen wie Gesundheitswesen, Sicherheit und autonomem Fahren transparent und zuverlässig macht.

Hast du schon einmal eine Antwort von einem Tool für künstliche Intelligenz (AI) wie ChatGPT gesehen und dich gefragt, wie es zu diesem Schluss gekommen ist? Dann bist du auf das „Black-Box“-Problem der AI gestoßen. Dieser Begriff beschreibt die fehlende Klarheit darüber, wie AI-Modelle Daten verarbeiten und analysieren. Selbst AI-Ingenieure und Wissenschaftler, die regelmäßig mit hochmodernen AI-Algorithmen arbeiten, können Schwierigkeiten haben, ihre Funktionsweise vollständig zu verstehen. Tatsächlich verstehen nur 22 % der IT-Fachleute die Fähigkeiten von AI-Tools wirklich.
Die Unsicherheit darüber, wie AI-Modelle Entscheidungen treffen, kann riskant sein, insbesondere in kritischen Bereichen wie Computer Vision im Gesundheitswesen und AI im Finanzwesen. Es werden jedoch erhebliche Fortschritte erzielt, um diese Herausforderungen zu bewältigen und die Transparenz zu verbessern.
Insbesondere erklärbare künstliche Intelligenz (XAI) konzentriert sich ausschließlich auf die Lösung dieses Problems. Einfach ausgedrückt handelt es sich um eine Reihe von Prozessen und Methoden, die menschlichen Nutzern helfen, die Ergebnisse oder Ausgaben komplexer Algorithmen des maschinellen Lernens zu verstehen und ihnen zu vertrauen.
XAI kann Entwicklern helfen sicherzustellen, dass AI-Systeme wie erwartet funktionieren. Außerdem kann sie AI-Unternehmen dabei unterstützen, regulatorische Standards einzuhalten. In diesem Artikel untersuchen wir erklärbare künstliche Intelligenz und ihre vielfältigen Anwendungsfälle. Legen wir los!
Die Bedeutung erklärbarer künstlicher Intelligenz#
Erklärbarkeit ist bei der Arbeit mit AI entscheidend. Das gilt besonders für das Teilgebiet Computer Vision, das in Branchen wie dem Gesundheitswesen vielfach eingesetzt wird. Beim Einsatz von Vision-Modellen in solch sensiblen Branchen ist es wichtig, dass die Funktionsweise des Modells für alle transparent und nachvollziehbar ist.
Die Interpretierbarkeit von Computer-Vision-Modellen hilft Nutzern, besser zu verstehen, wie eine Vorhersage zustande gekommen ist und welche Logik dahintersteckt. Transparenz ergänzt dies, indem sie die Funktionsweise des Modells für alle verständlich macht, seine Einschränkungen klar aufzeigt und sicherstellt, dass Daten ethisch verwendet werden. Computer Vision kann beispielsweise Radiologen dabei helfen, gesundheitliche Komplikationen auf Röntgenbildern effizient zu erkennen.

Abb. 1. Bruströntgenaufnahmen, die mithilfe von Vision AI analysiert wurden und Klassifizierungen für gesunde, erkrankte, aktive und latente Tuberkulose zeigen.
Ein genaues Vision-System allein reicht jedoch nicht aus. Das System muss auch in der Lage sein, seine Entscheidungen zu erklären. Angenommen, das System könnte zeigen, welche Bildbereiche zu seinen Schlussfolgerungen geführt haben – dann wären die Ausgaben klarer. Ein solches Maß an Transparenz würde medizinischem Fachpersonal helfen, seine Befunde zu überprüfen und sicherzustellen, dass die Patientenversorgung medizinischen Standards entspricht.
Ein weiterer Grund für die Bedeutung der Erklärbarkeit ist, dass sie AI-Unternehmen zur Verantwortung zieht und Vertrauen bei den Nutzern schafft. Vertrauenswürdige AI gibt Nutzern die Sicherheit, dass AI-Innovationen zuverlässig funktionieren, faire Entscheidungen treffen und verantwortungsvoll mit Daten umgehen.
Wichtige XAI-Techniken in Computer Vision#
Nachdem wir besprochen haben, warum Erklärbarkeit in Computer Vision wichtig ist, sehen wir uns nun die wichtigsten XAI-Techniken an, die in Vision AI eingesetzt werden.
Salienz-Karten#
Neuronale Netze sind vom menschlichen Gehirn inspirierte Modelle, die darauf ausgelegt sind, Muster zu erkennen und Entscheidungen zu treffen, indem sie Daten durch miteinander verbundene Schichten aus Knoten (Neuronen) verarbeiten. Sie können komplexe Computer-Vision-Probleme mit hoher Genauigkeit lösen. Trotz dieser Genauigkeit bleiben sie konstruktionsbedingt Black Boxes.
Salienz-Karten sind eine XAI-Technik, mit der sich besser nachvollziehen lässt, was neuronale Netze bei der Analyse von Bildern erkennen. Sie können auch zur Fehlersuche bei Modellen eingesetzt werden, wenn diese nicht wie erwartet funktionieren.
Salienz-Karten konzentrieren sich auf die Bildbereiche (Pixel), die die Vorhersagen eines Modells bestimmen. Dieser Prozess ähnelt stark der Rückpropagation, bei der das Modell von den Vorhersagen zum Eingang zurückverfolgt. Anstatt jedoch die Gewichte des Modells auf Grundlage von Fehlern zu aktualisieren, betrachten wir lediglich, wie wichtig jedes Pixel für die Vorhersage ist. Salienz-Karten sind für Computer-Vision-Aufgaben wie die Bildklassifizierung sehr nützlich.
Wenn ein Modell zur Bildklassifizierung beispielsweise vorhersagt, dass ein Bild einen Hund zeigt, können wir seine Salienz-Karte betrachten, um zu verstehen, warum das Modell einen Hund erkennt. So lässt sich feststellen, welche Pixel die Ausgabe am stärksten beeinflussen. Die Salienz-Karte würde alle Pixel hervorheben, die dazu beigetragen haben, dass das Bild letztendlich als Hund klassifiziert wurde.

Abb. 2. Eine Gegenüberstellung der Eingabebilder und ihrer Salienz-Karten.
Klassenaktivierungskartierung (CAM)#
Die Klassenaktivierungskartierung ist eine weitere XAI-Technik, mit der sich nachvollziehen lässt, auf welche Bildbereiche sich ein neuronales Netz bei Vorhersagen zur Bildklassifizierung konzentriert. Sie funktioniert ähnlich wie Salienz-Karten, konzentriert sich jedoch darauf, wichtige Merkmale im Bild statt einzelner Pixel zu identifizieren. Merkmale sind Muster oder Details wie Formen oder Texturen, die das Modell im Bild erkennt.
Methoden wie die gradientengewichtete Klassenaktivierungskartierung (Grad-CAM) und Grad-CAM++ bauen auf derselben Idee auf und bieten einige Verbesserungen.
So funktioniert CAM:
- Bevor das neuronale Netz seine endgültige Entscheidung trifft, verwendet es einen Schritt namens globales Mittelwert-Pooling (GAP), um die Informationen zu vereinfachen. GAP fasst alle Pixel eines erkannten Musters zu einem einzigen Durchschnittswert zusammen und erstellt so eine Zusammenfassung für jede Merkmalskarte (eine visuelle Darstellung erkannter Muster).
- Anschließend wird jeder Merkmalskarte ein Gewicht zugewiesen, das zeigt, wie wichtig sie für die Vorhersage einer bestimmten Klasse ist (etwa „Vogel“ oder „Katze“).
- Eine Einschränkung von CAM besteht jedoch darin, dass du das Modell möglicherweise neu trainieren musst, um diese Gewichte zu berechnen, was zeitaufwendig sein kann.
Grad-CAM verbessert dies durch die Verwendung von Gradienten, die Signalen ähneln und zeigen, wie stark jede Merkmalskarte die endgültige Vorhersage beeinflusst. Diese Methode macht GAP überflüssig und erleichtert es, ohne erneutes Training zu erkennen, worauf sich das Modell konzentriert. Grad-CAM++ geht noch einen Schritt weiter, indem es sich ausschließlich auf positive Einflüsse konzentriert, wodurch die Ergebnisse noch klarer werden.

Abb. 3. Vergleich von CAM, Grad-CAM und Grad-CAM++.
Kontrafaktische Erklärungen#
Kontrafaktische Erklärungen sind ein wichtiges Element erklärbarer künstlicher Intelligenz. Eine kontrafaktische Erklärung beschreibt eine Situation oder ein Ergebnis, indem sie alternative Szenarien oder Ereignisse betrachtet, die nicht eingetreten sind, aber hätten eintreten können. Sie kann zeigen, wie Änderungen bestimmter Eingabevariablen zu anderen Ergebnissen führen, etwa: „Wenn X nicht passiert wäre, wäre Y nicht eingetreten.“
Bei AI und Computer Vision identifiziert eine kontrafaktische Erklärung die kleinste erforderliche Änderung an einer Eingabe (etwa einem Bild oder Daten), damit ein AI-Modell ein anderes, bestimmtes Ergebnis erzeugt. So könnte die Änderung der Farbe eines Objekts in einem Bild die Vorhersage eines Bildklassifizierungsmodells von „Katze“ zu „Hund“ verändern.
Ein weiteres gutes Beispiel wäre die Änderung des Blickwinkels oder der Beleuchtung in einem Gesichtserkennungssystem. Dadurch könnte das Modell eine andere Person identifizieren und zeigen, wie kleine Änderungen an der Eingabe die Vorhersagen des Modells beeinflussen können.
Die einfachste Methode, solche Erklärungen zu erstellen, ist Versuch und Irrtum: Du kannst Teile der Eingabe (etwa Bildmerkmale oder Daten) zufällig verändern, bis das AI-Modell das gewünschte Ergebnis liefert. Weitere Methoden sind modellunabhängige Ansätze, die Optimierungs- und Suchverfahren verwenden, um Änderungen zu finden, sowie modellspezifische Ansätze, die sich auf interne Einstellungen oder Berechnungen stützen, um die erforderlichen Änderungen zu ermitteln.
Anwendungen erklärbarer künstlicher Intelligenz in Computer Vision#
Nachdem wir untersucht haben, was XAI ist und welche zentralen Techniken es gibt, sehen wir uns an, wie XAI im Alltag eingesetzt wird. XAI bietet vielfältige Anwendungsmöglichkeiten in zahlreichen Bereichen. Sehen wir uns einige Anwendungsfälle an, die das Potenzial verdeutlichen:
- Sicherheitssysteme: XAI kann zur Verbesserung von Sicherheitssystemen eingesetzt werden, indem manipulierte Bilder in Identitätsdokumenten wie Reisepässen und Führerscheinen erkannt werden. Dies stellt die Authentizität der Bilder sicher, stärkt die Identitätsprüfung und verhindert betrügerische Aktivitäten in sensiblen Anwendungen.

Abb. 4. So erkennt XAI manipulierte Bilder.
-
Autonomes Fahren: Das Verständnis der Fähigkeiten und Einschränkungen des integrierten Vision-AI-Systems eines selbstfahrenden Autos kann ein wesentlicher Bestandteil der Erprobung des Fahrzeugs sein, bevor es auf echten Straßen eingesetzt wird. XAI kann Automobilunternehmen dabei helfen, Probleme klarer zu erkennen und zu beheben.
-
Justizsysteme: Systeme zur dokumentengestützten Analyse werden zunehmend bei gerichtlichen Entscheidungen eingesetzt. XAI unterstützt faire Ergebnisse und ermöglicht die Überprüfung automatisierter Urteile. Außerdem hilft sie Juristen zu verstehen, wie ein AI-Modell zu seinen Entscheidungen gelangt.
-
Überwachung von Wildtieren: Kamerafallen werden häufig eingesetzt, um Wildtiere zu beobachten und Daten über Tierarten zu sammeln. XAI kann erklären, wie AI diese Arten in den Bildern klassifiziert. Dadurch können Naturschutzmaßnahmen zuverlässiger und präziser werden.
Die wichtigsten Erkenntnisse zu erklärbarer künstlicher Intelligenz#
Erklärbare künstliche Intelligenz erleichtert das Verständnis dafür, wie AI-Systeme funktionieren und warum sie bestimmte Entscheidungen treffen. Transparenz bei AI-Modellen schafft Vertrauen und Verantwortlichkeit. Wissen ist Macht und trägt dazu bei, AI-Innovationen verantwortungsvoller einzusetzen. In kritischen Bereichen wie dem Gesundheitswesen, der Sicherheit, dem autonomen Fahren und Justizsystemen kann XAI Entwicklern und Nutzern helfen, AI-Vorhersagen zu verstehen, Fehler zu erkennen und eine faire und ethische Nutzung sicherzustellen. Indem XAI AI transparenter macht, überbrückt sie die Kluft zwischen Technologie und menschlichem Vertrauen und macht AI für Anwendungen in der Praxis sicherer und zuverlässiger.
Weitere Informationen findest du in unserem GitHub-Repository. Außerdem kannst du dich in unserer Community austauschen. Entdecke auf unseren Lösungsseiten AI-Anwendungen für selbstfahrende Autos und die Landwirtschaft. 🚀









