Eine KI-Studie der Beratungsfirma KPMG sollte die wunderbare Welt der agentischen KI preisen. Stattdessen lieferte der Bericht den besten Beweis, dass KI noch lange nicht verlässlich funktioniert. GPTZero fand erfundene Fallstudien über UBS, die NHS und Schweizer Bundesbahnen. Daraufhin zog KPMG den Bericht eilig zurück.
Nur 5 von 45 Quellen stimmen
Der Bericht mit dem Titel „Redefining Excellence in the Age of Agentic AI“ erschien im Oktober 2025. GPTZero, ein Spezialist für KI-Erkennung, prüfte alle 45 Quellenangaben. Das Ergebnis ist vernichtend: Lediglich fünf Verweise führen zu echten, korrekten Quellen. Die restlichen 40 sind entweder verfälscht, ungenau oder völlig erfunden. GPTZero nennt dieses Phänomen „Vibe Citing“, also das zitieren nach Gefühl. Dabei bastelt eine KI aus echten Fragmenten neue Quellen zusammen, die überzeugend wirken, bis jemand tatsächlich nachprüft.
Darüber hinaus seien etwa die Hälfte aller inhaltlichen Behauptungen falsch, nicht belegt oder der falschen Quelle zugeordnet. Die KI hatte offenbar den Auftrag erhalten, Beispiele für agentische KI in der Praxis zu finden. Dafür erfand sie kurzerhand welche.
Erfundene Fallstudien bei UBS und NHS
Besonders peinlich werden die erfundenen Fallstudien. KPMG behauptete beispielsweise, dass die Schweizer Großbank UBS KI-Agenten in der Anlageberatung, im Risikomanagement und bei der Compliance-Überwachung einsetzt. Eine Sprecherin von UBS nannte diese Darstellung gegenüber der Financial Times „faktisch falsch“. Ebenso erfunden: Die Schweizer Bundesbahnen sollen laut Bericht KI-Agenten einsetzen, die Reisenden bei der Buchung und Routenplanung helfen. Eine Sprecherin der Bahn bestätigte, dass dies „nicht zutreffend“ sei.
Auch Transport for London soll angeblich KI-Agenten zur Stauvorhersage und zur Verkehrssteuerung nutzen. Das bezeichnete eine Sprecherin als „irreführend“. Der Bericht behauptete zudem, NHS Greater Manchester setze KI-Agenten zur Patienten-Triage und zur automatischen Überweisung ein. Tatsächlich basierte diese Behauptung auf einer Pressemitteilung über ein KI-Tool zur Lungenkrebsfrüherkennung. Von agentischer KI war dort keine Rede.
Emirates und der Roboter-Sarah
Auf Seite 42 des Berichts steht, die Fluglinie Emirates habe einen mobilen Chatbot namens Sara eingeführt, der mit Passagieren sprechen und Flüge ändern könne. Tatsächlich ist Sara ein physischer Roboter-Assistent aus dem Jahr 2023, kein Chatbot. Und Flüge ändern kann er schon gar nicht. Selbst innerhalb von KPMG gibt es Widersprüche: Der Bericht gibt an, 55 Prozent der CEOs sähen KI als Top-Investitionspriorität. KPMGs eigene CEO-Studie aus demselben Monat nannte 71 Prozent.
Das Problem der zweiten Halluzination
GPTZero-Chef Edward Tian warnt vor sogenannten sekundären Halluzinationen. Große Beratungshäuser wie KPMG gelten als glaubwürdig. Wenn deren Veröffentlichungen falsche Informationen enthalten, werden diese von anderen Medien und KI-Systemen übernommen. Die GPTZero-Untersuchung zeigt, dass KPMGs Ergebnisse bereits von Branchenpublikationen und einer großen tschechischen Zeitung zitiert wurden. Damit verbreiten sich die erfundenen Fakten weiter, ohne dass jemand die Ursprungsquelle hinterfragt.
KPMG ist nicht der einzige Fall. EY zog erst im vergangenen Monat eine Studie über Kundenbindungsprogramme zurück, die fingierte Fußnoten enthielt. Auch Deloitte musste einen Regierungsbericht in Australien korrigieren, weil KI-generierte Inhalte eingeschlichen waren. Südafrika zog seine gesamte nationale KI-Strategie zurück, nachdem mindestens sechs von 67 akademischen Quellen als KI-Fiktion entlarvt wurden.
Folgen für die Beratungsbranche
Der Vorfall ist für KPMG doppelt peinlich. Das Unternehmen hat sich bereits mit Anthropic zusammengetan, um Claude bei allen 276.000 Mitarbeitern einzuführen. Die Partnerschaft soll KI in Beratung, Prüfung und Steuerarbeit verankern. Der zurückgezogene Bericht zeigt nun, was passiert, wenn diese Integration schneller vorangeht als die Qualitätskontrolle. Für KPMGs Kunden stellt sich eine unbequeme Frage: Wenn die öffentliche Thought-Leadership ohne ausreichende Prüfung auskommt, wie sieht es dann mit der vertraglichen Arbeit aus?
Das Problem trifft auch Unternehmen, die KI einsetzen, ohne die Kosten und Risiken zu kennen. Beratungshäuser warnen ihre Kunden seit Jahren vor KI-Halluzinationen. Jetzt haben sie selbst die beste Warnung geliefert: einen lebenden Beweis in Form eines eigenen Berichts.