Vordenker
Wie Erklärbarkeit die Zuverlässigkeit und Vertrauenswürdigkeit von KI erhöht

Da künstliche Intelligenz (KI) in Unternehmen immer mehr verbreitet wird, wird sie langsam Teil unseres täglichen Lebens. Ein wichtiger Aspekt dieser Verbreitung ist, dass Endnutzer den Prozess und die Mechanismen, die KI verwendet, um zu einer Schlussfolgerung zu gelangen oder um die gewünschten Ergebnisse zu erzielen, vollständig verstehen können. Als Menschen haben wir ein tiefes Bedürfnis, das “Warum” und “Wie” jedes Phänomens zu verstehen, was unseren technologischen Fortschritt beschleunigt hat. Im Kontext von KI wird dieses Verständnis als “Erklärbarkeit” bezeichnet.
Warum ist Erklärbarkeit dringend notwendig?
Meistens betrachten wir KI als eine “Black Box”, bei der wir nur die Eingaben und Ausgaben kennen, aber die verwendeten Prozesse uns nicht bekannt sind. Dieses Problem wird noch verstärkt durch die Tatsache, dass die Algorithmen, die die meisten Formen von KI antreiben, wie komplexe Deep-Learning-Systeme und Natural Language Processing (NLP), sehr abstrakt sind, sogar für ihre erfahrensten Anwender.
Vertrauen und Transparenz: Damit Nutzer den Vorhersagen von KI vertrauen, muss KI ein bestimmtes Maß an Erklärbarkeit besitzen. Zum Beispiel muss ein Arzt, der aufgrund von KI-Vorhersagen eine Behandlung empfiehlt, sich auf die Vorhersage verlassen können. Eine Bank muss vollständiges Vertrauen in die Entscheidung haben, einen Kredit zu ablehnen oder zu genehmigen, und diese Entscheidung gegenüber allen Beteiligten rechtfertigen können. Ein KI-System, das für die Auswahl und Einstellung von Bewerbern verwendet wird, muss nachweisen, dass die zugrunde liegenden Mechanismen fair und gerecht für alle Bewerbergruppen sind.
Macht KI menschlicher und erhöht die Akzeptanz: In dem Bericht “The State of AI in 2020” von McKinsey erfahren wir, dass ein Hersteller sehr transparente Modelle für die Akzeptanz durch die Fabrikarbeiter verwendet, die dem Urteil von KI über ihre Sicherheit vertrauen müssen. Für eine schnelle Akzeptanz von KI ist es wichtig, die Zustimmung der Beteiligten zu erhalten, was ein großes Hindernis für die Skalierung von einfachen Punktlösungen auf Unternehmensebene darstellt. Dies wird erheblich erleichtert, wenn die Leistung von KI für ein breiteres Publikum erklärbar ist. Aus geschäftlicher Sicht verbessert Erklärbarkeit die gesamte Nutzererfahrung und erhöht die Kundenzufriedenheit. Laut einer Umfrage des IBM Institute for Business Value glauben 68 Prozent der Top-Manager, dass Kunden in den nächsten drei Jahren mehr Erklärbarkeit von KI verlangen werden.
Entdeckt Vorurteile und verbessert die Modellleistung: Ein Entwickler muss wissen, wie er die Leistung des Modells verbessern und wie er es debuggen und feinjustieren kann. Ein klares Erklärbarkeitsframework ist eines der wichtigsten Werkzeuge für die Durchführung der gründlichen Analyse, die benötigt wird.
Erhält scharfe, umfassende Einblicke: Für ein vollständiges Verständnis der von KI gemachten Vorschläge ist eine umfassende 360-Grad-Perspektive erforderlich. Zum Beispiel muss man, wenn KI für eine Investitionsentscheidung verwendet wird, auch die Begründung dafür kennen, um diese Erkenntnisse in anderen Bereichen anwenden und die möglichen Risiken dieser Entscheidung verstehen zu können. Ein tiefes Verständnis der Funktionsweise von KI ermöglicht es Entscheidungsträgern auch, neue Anwendungsfälle zu entdecken.
Regulierungen und Rechenschaftspflicht: Viele Regulierungen wie die DSGVO verlangen ein Recht auf Erklärung, um die Rechenschaftspflicht zu gewährleisten, die durch automatisierte Entscheidungsprozesse entsteht. In Systemen wie autonomen Fahrzeugen ist es, wenn etwas schiefgeht und Menschenleben oder Sachschäden verursacht werden, wichtig, die Ursache genau zu kennen, was in einem Black-Box-System schwierig zu bestimmen wäre.
Wie kann KI erklärbarer gemacht werden?
Erklärbare künstliche Intelligenzsysteme (XAI) werden mithilfe verschiedener Techniken entwickelt, die sich entweder auf die Erklärung des gesamten Modells oder auf die Erklärung der Begründung für einzelne Vorhersagen konzentrieren.
Die meisten Erklärbarkeitstechniken basieren auf:
- Aufteilung eines Modells in einzelne Komponenten)
- Visualisierung von Modellvorhersagen (zum Beispiel, wenn ein Modell ein Auto einer bestimmten Marke zuordnet, hebt es den Teil hervor, der es dazu veranlasst hat, es als solche zu identifizieren)
- Erklärungsbergbau (Verwendung von Machine-Learning-Techniken, um relevante Daten zu finden, die die Vorhersage eines KI-Algorithmus erklären).
Bei einer solchen Technik, dem sogenannten Proxy-Modellieren, wird ein einfacheres und verständlicheres Modell wie ein Entscheidungsbaum verwendet, um das komplexere KI-Modell approximativ darzustellen. Diese einfachen Erklärungen geben eine gute Vorstellung vom Modell auf hohem Niveau, können aber manchmal bestimmte Nuancen unterdrücken.
Ein anderer Ansatz ist “Erklärbarkeit durch Design”. Dieser Ansatz legt Beschränkungen in der Konstruktion und dem Training von KI-Netzwerken, um das gesamte Netzwerk aus kleineren und einfacheren erklärbareren Komponenten aufzubauen. Dies erfordert einen Kompromiss zwischen dem Grad der Genauigkeit und der Erklärbarkeit und schränkt bestimmte Ansätze aus dem Werkzeugkasten der Datenwissenschaftler ein. Es kann auch sehr rechenintensiv sein.
Die Schulung und der Test von KI können auch agnostische Datenverifizierungstechniken wie Local Interpretable Model (LIME) und Shapley Additive Erklärungen (SHAP) verwenden, und diese sollten so angepasst werden, dass sie durch die Verwendung von F-Score, Präzision und anderen Metriken eine hohe Genauigkeit erreichen. Und natürlich sollten alle Ergebnisse mit einer Vielzahl von Daten überwacht und verifiziert werden. Mit LIME können Organisationen beispielsweise temporäre Modelle erstellen, die die Vorhersagen nicht transparenter Algorithmen wie Machine Learning nachahmen. Diese LIME-Modelle können dann eine Vielzahl von Permutationen auf der Grundlage eines gegebenen Datensatzes und seiner entsprechenden Ausgabe erstellen, die dann verwendet werden können, um einfache und interpretierbare Modelle mit vollständigen Erklärungen für jede Entscheidung und/oder Vorhersage zu trainieren. Das SHAP-Framework, das auf der Spieltheorie und speziell auf der kooperativen Spieltheorie basiert, ist ein Modell, das die optimale Gutschriftszuweisung mit lokalen Erklärungen unter Verwendung der ursprünglichen Shapley-Werte aus der Spieltheorie und ihrer Nachfolger kombiniert.
Prinzipielle Betriebsweisen
Auf strategischer Ebene sollten KI-Zuverlässigkeitsframeworks jedoch einen breiten Satz von Grundsätzen umfassen, die darauf abzielen, ordnungsgemäße Ergebnisse sowohl bei der ersten Bereitstellung als auch über die Zeit hinweg zu gewährleisten, wenn Modelle im Laufe der Zeit im Hinblick auf veränderte Umstände evolvieren. Mindestens sollten diese Frameworks Dinge wie Folgendes umfassen:
- Vorurteilsdetektion – alle Datensätze sollten von Vorurteilen und diskriminierenden Attributen bereinigt und dann mit der richtigen Gewichtung und Diskretion beim Training des Modells verwendet werden;
- Menschliche Beteiligung – Bediener sollten in der Lage sein, die Ausgaben von Algorithmen zu untersuchen und zu interpretieren, insbesondere wenn Modelle für die Strafverfolgung und die Wahrung der bürgerlichen Freiheiten verwendet werden;
- Rechtfertigung – alle Vorhersagen müssen der Prüfung standhalten, was naturgemäß eine hohe Transparenz erfordert, um es externen Beobachtern zu ermöglichen, die Prozesse und Kriterien zu beurteilen, die zur Erzielung der Ergebnisse verwendet wurden;
- Reproduzierbarkeit – zuverlässige KI-Modelle müssen in ihren Vorhersagen konsistent sein und hohe Stabilitätsniveaus aufweisen, wenn sie auf neue Daten stoßen.
Aber XAI sollte nicht nur als Mittel zur Verbesserung der Rentabilität betrachtet werden, sondern auch, um die Rechenschaftspflicht zu gewährleisten, dass Institutionen die Auswirkungen ihrer Schöpfungen auf die Gesellschaft als Ganzes erklären und rechtfertigen können.












