Einen KI-Agenten gegen den EU AI Act prüfen und zum Go-live führen
Die Aufgabe
Ein KI-System ist fertig und läuft. Ob es laufen darf, weiß im Haus niemand sicher zu sagen.
KI-generiert ist der Go-live-Stand des geprüften KI-Agenten — nach Umsetzung aller kritischen und hochprioren Maßnahmen und erneuter Prüfung
Maßnahmen im priorisierten Katalog, in drei Dringlichkeitsstufen von Zugriffsschutz und Prompt-Härtung bis Löschkonzept und Aufsichtskonzept
in einer Prüfung zusammengeführt: EU AI Act, Datenschutzrecht des Bundes und eines weiteren Mitgliedstaats sowie die Norm für KI-Managementsysteme
Kurz zum Kunden
Ein deutscher Hersteller von Systemlösungen für Wärme und Energie im Gebäude, eigentümergeführt und in einer Unternehmensgruppe organisiert. Das Erzeugnisprogramm reicht von Flächenheizungen und Rohrsystemen über Wärmepumpen und Lüftung bis zu Photovoltaik, Batteriespeichern und Energiemanagement. Verkauft wird über den Großhandel und das Installationshandwerk, dazu kommen Planung, Schulung und Service. Der Kundenservice ist damit keine Nebenstelle, sondern die Stelle, an der täglich viele hundert Anfragen ankommen — und genau dort setzt der geprüfte KI-Agent an.
Unsere Lösung
Eine Prüfung, die mit einer Mängelliste endet, verändert nichts. Diese endete erst, als das System bereit war.
Die Aufgabe
Ein Hersteller von Heiztechnik hat einen KI-Agenten für den Kundenservice entwickelt. Eingehende Kundenmails werden automatisch gelesen, mit einem Sprachmodell in drei Kategorien eingeordnet und als Ticket im Servicesystem angelegt, das zuständige Team erhält eine Benachrichtigung. Das System ist technisch fertig, es läuft auf eigenen Servern im Haus, und der Produktivbetrieb soll beginnen. Offen ist die andere Frage: Darf es das? Ein KI-System, das Kundenkorrespondenz verarbeitet, berührt gleich mehrere Regelwerke auf einmal, und keines davon beantwortet die Frage allein. Gesucht ist deshalb kein Gutachten über Künstliche Intelligenz im Allgemeinen, sondern eine Prüfung dieses einen Systems mit einem Ergebnis, das die Geschäftsführung vor die Entscheidung über den Go-live stellen kann — und ein Rahmen, der für die nächsten KI-Anwendungen nicht wieder von vorn beginnt.
Unser Ansatz
Der bestätigende Bericht kam nach der Umsetzung, nicht davor. Der übliche Ablauf einer Prüfung ist eine Momentaufnahme: Man sieht sich das System an, schreibt auf, was fehlt, und übergibt. Was danach geschieht, ist die Sache des Kunden. Hier war es umgekehrt vereinbart. Die ersten fünf Prüfmodule liefen im März, daraus entstand der Maßnahmenkatalog. Das Unternehmen hat gearbeitet, den Stand dokumentiert und zurückgemeldet; wir haben nachgeprüft und erst im Mai die Gesamtbewertung abgeschlossen. Ein Bericht, der einen Zustand bestätigt, den es noch nicht gibt, ist wertlos — und einer, der nur Mängel benennt, hilft niemandem über die Ziellinie.
Geprüft wurde gegen vier Rahmenwerke gleichzeitig, weil eines nicht reicht. Der EU AI Act beantwortet die Frage nach der Risikoklasse und den daraus folgenden Pflichten. Er sagt nichts darüber, auf welcher Rechtsgrundlage Kundenmails verarbeitet werden dürfen, wie ein Löschkonzept aussieht oder wer Betroffenenrechte bearbeitet — das steht im Datenschutzrecht, und weil ein Teil der Korrespondenz aus einem anderen Mitgliedstaat kommt, waren dessen nationale Besonderheiten mitzuprüfen. Wie das Unternehmen KI dauerhaft steuert, steht in keinem der beiden; dafür stand die Norm für KI-Managementsysteme daneben. Vier Rahmenwerke in einer Prüfung zusammenzuführen ist aufwendiger als vier getrennte Prüfungen und der einzige Weg, an dessen Ende eine Entscheidung steht statt vier Teilbefunde.
Die Einstufung war der leichte Teil. Geringes Risiko klingt nach Entwarnung und ist keine. Die Aufgabe ist eng umgrenzt, ein Mensch entscheidet am Ende, autonome Entscheidungen mit rechtlicher Wirkung gibt es nicht — daraus folgt eine niedrige Klasse. Daraus folgt aber auch eine Reihe von Pflichten, die man erfüllen muss, gerade weil sie niemand für dringlich hält: Der Kunde muss erfahren, dass ein KI-System mitliest. Die menschliche Aufsicht muss beschrieben sein und nicht nur behauptet. Der Prompt gehört dokumentiert, das Protokoll gegen nachträgliche Änderung gesichert, die Einstufung jährlich neu bewertet. Der Aufwand einer Prüfung liegt nicht in der Klassifizierung, sondern in dem, was danach kommt.
Der Bericht sagt auch, was gut war, und er sagt, wo unsere Aussage endet. Aufgeschrieben ist ausdrücklich, dass die Verarbeitung im eigenen Haus stattfindet, dass die Einwilligung vor jeder KI-Verarbeitung einzeln eingeholt wird und damit über das gesetzlich Erforderliche hinausgeht und dass die Datenschutz-Folgenabschätzung bereits vorlag. Ebenso ausdrücklich steht im Brief an die Geschäftsführung, dass er das fachlich-methodische Ergebnis unserer Prüfung dokumentiert, keine Rechtsberatung ist und die juristische Bewertung durch qualifizierte Rechtsberatung und den Datenschutzbeauftragten empfohlen bleibt. Beides gehört zusammen: Wer eine Prüfung ernst nimmt, benennt ihre Reichweite.
Der zweite Teil des Auftrags war der Rahmen für alles Weitere. Ein einzelner geprüfter Arbeitsablauf ist ein guter Anfang und skaliert nicht: Jede weitere KI-Anwendung müsste erneut einzeln aufgesetzt, einzeln dokumentiert und einzeln geprüft werden. Vorgesehen war deshalb ein eigenes AI-Compliance-Framework für das Unternehmen — Rollenmodell und Freigabeprozesse, eine unternehmensspezifische Prüfliste mit Bewertungsraster, Vorlagen für Risikoanalyse, und Audit-Nachweise sowie ein Betriebsmodell, das festlegt, wer eine KI-Anwendung verantwortet. Empfohlen haben wir zusätzlich, die weiteren Anwendungsfälle systematisch zu erheben und die Agenten künftig auf einer gemeinsamen Plattform zu betreiben statt als einzelne Abläufe nebeneinander.
Das Ergebnis
Ein vollständiges Compliance Assessment des KI-Agenten in sechs Prüfmodulen.
Sie reichen von der Systemdefinition über die regulatorische und die technische Prüfung bis zu Governance, Reifegrad und Gesamtbewertung. Ergebnis ist die Einstufung als System mit geringem Risiko nach EU AI Act samt der daraus folgenden Transparenz- und Informationspflichten, eine Reifegradbewertung über alle Dimensionen und ein priorisierter Katalog von neununddreißig Maßnahmen in drei Dringlichkeitsstufen — von der Absicherung gegen manipulierte Eingaben über individuelle Benutzerkonten und Zwei-Faktor-Anmeldung bis zu Löschkonzept, Verarbeitungsverzeichnis, Fehlerbehandlung und einem dokumentierten Konzept für die menschliche Aufsicht.
Danach hat das Unternehmen die Maßnahmen umgesetzt; wir haben den Stand geprüft und erst dann den abschließenden Bericht und den Compliance Brief an die Geschäftsführung übergeben, der den Go-live-Stand des Systems bestätigt.
Diese Leistungen steckten im Projekt
Weitere Projekte
Alle Referenzen ansehen


Kontakt
Sprechen Sie uns an
Schreiben Sie uns eine Zeile. Wir ordnen Ihre Frage ein und melden uns.
