KI-Studien richtig lesen: Der viel zitierte Widerspruch steht in keiner der beiden
82 Prozent nutzen generative KI, 95 Prozent verbuchen nichts: Der berühmte Widerspruch entsteht erst beim Zitieren. Was die beiden Studien wirklich messen und welche Frage danach offen bleibt.
Zwei Zahlen laufen seit Monaten durch Vorträge, Vorstandsvorlagen und Vertriebsunterlagen, meist unmittelbar hintereinander. 82 Prozent nutzen generative KI mindestens wöchentlich, und rund 95 Prozent verbuchen daraus nichts. Erst das Staunen über die Verbreitung, dann die Ernüchterung über den Ertrag. Wer beide , hat scheinbar bewiesen, dass ein ganzer Markt an sich selbst vorbeiarbeitet.
Die Zahlen widersprechen sich nicht. Sie messen Verschiedenes, und erst wenn man weiß, was genau, wird eine von beiden zur Entscheidungsgrundlage.
Was die beiden Erhebungen tatsächlich messen
Die erste Zahl steht in *Accountable Acceleration: Gen AI Fast-Tracks Into the Enterprise*, herausgegeben von Wharton Human-AI Research an der University of Pennsylvania zusammen mit GBK Collective. Befragt wurden rund achthundert Führungskräfte großer amerikanischer Unternehmen, in einer Online-Erhebung von einer Viertelstunde. Gemessen wird damit Verhalten, also wie oft jemand ein solches Werkzeug öffnet. Dass 82 Prozent das mindestens wöchentlich tun, ist eine Aussage über Verbreitung, nicht über Wirkung.
In derselben Erhebung steht der Satz, dass 72 Prozent „structured, business-linked ROI metrics“ verfolgen. Genau hier entsteht das erste Missverständnis, und es entsteht in der Übersetzung. Aus „Kennzahlen verfolgen“ wird beim Zitieren „ROI messen“. Erhoben wird nicht, dass sich etwas rechnet, sondern dass jemand Kennzahlen dafür führt. Die Zahl sagt, wie viele Häuser hinsehen. Sie sagt nichts darüber, was sie sehen.
Die zweite Zahl steht in *The GenAI Divide: State of AI in Business 2025* von Project NANDA am MIT Media Lab. Dort werden integrierte, eigens zugeschnittene Pilotprojekte betrachtet, und gemessen wird der nachweisbare Niederschlag in der Gewinn- und Verlustrechnung, und zwar binnen sechs Monaten. Dass rund 95 Prozent dort nichts finden, ist mit der ersten Zahl vollständig vereinbar. Es ist sogar zu erwarten. Werkzeugnutzung durch einzelne Mitarbeiter erzeugt keine Buchung.
Wie belastbar die zweite Zahl ist
Hier lohnt sich der Blick ins Original, denn die Untersuchung wird fast überall falsch zugeschrieben: Zitiert wird sie als Arbeit der MIT Sloan School of Management. Sie trägt den Vermerk „Preliminary Findings“ und ist nicht begutachtet. Ihre Grundlage sind zweiundfünfzig Interviews und Befragte von Branchenkonferenzen. Die vielzitierte Quote wird im Bericht nicht hergeleitet, und rund vier Fünftel der erfassten Unternehmen haben überhaupt nie einen zugeschnittenen Piloten begonnen. Rechnet man nur die, die es getan haben, liegt die Erfolgsquote bei etwa einem Viertel.
Das entwertet die Untersuchung nicht. Sie beschreibt ein reales Muster, und wer mit Unternehmen arbeitet, erkennt es wieder. Aber sie trägt nicht, was ihr aufgeladen wird. Sie ist keine Messung Produktivität und kein Beleg dafür, dass KI insgesamt nichts einbringt. Beides wird regelmäßig daraus gemacht.
Was aus beiden Zahlen zusammen folgt
Nutzung ist kein Zwischenergebnis auf dem Weg zur Wirkung. Die verbreitete Annahme lautet, breite Nutzung führe früher oder später zu messbarem Nutzen. Die beiden Erhebungen zeigen das Gegenteil. Die Nutzung ist bereits hoch, der Ertrag nicht. Zwischen beidem liegt kein Zeitablauf, sondern eine Gestaltungsentscheidung.
Die entscheidende Größe ist die Stelle, nicht die Menge. Ein Werkzeug, das jeder für sich verwendet, spart jedem einzelnen Minuten und verändert keine Zeile in der Kostenrechnung, weil die eingesparte Zeit nirgendwo zusammenläuft. Wirkung entsteht dort, wo ein Vorgang als Ganzes anders abläuft.
Die Kennzahl muss vor der Einführung stehen. Dass drei Viertel der Häuser Kennzahlen führen, klingt nach Reife. Entscheidend ist, wann sie definiert wurden. Eine Kennzahl, die nach der Einführung gesucht wird, findet immer etwas, meistens die Nutzung, weil sie am leichtesten zu erheben ist.
Was daraus für die eigene Vorlage folgt
Wer die beiden Zahlen im eigenen Haus zitiert, sollte sie nicht als Gegensatz aufbauen. Der Gegensatz ist rhetorisch wirksam und sachlich falsch, und jemand im Raum wird das merken. Tragfähig ist die Fassung, in der beide Zahlen ihren Messgegenstand mitbringen. Verbreitung ist erreicht, Ertrag nicht, und der Unterschied liegt nicht in der Technik, sondern darin, ob ein Vorgang verändert wurde oder nur ein Hilfsmittel dazugekommen ist.
Daraus wird eine Frage, die sich beantworten lässt: Welchen Vorgang wollen wir anders ablaufen lassen, woran messen wir das, und wer bemerkt die Veränderung außerhalb des Bereichs, der sie eingeführt hat? Diese drei Fragen kosten eine Sitzung. Sie entscheiden darüber, auf welcher Seite der beiden Zahlen ein Haus am Ende steht.
Fragen zu diesem Beitrag? Schreiben Sie uns über das Kontaktformular.
