Anthropic J-Space: Claudes heimliches Denken enthüllt KI-Bewusstseins-Struktur

von Marcel Buchholz 07. Juli 2026 3 Min. Lesezeit News, Software & Entwicklung

Anthropic hat in seinem KI-Modell Claude eine interne Struktur entdeckt, die erstaunliche Parallelen zum menschlichen Bewusstsein aufweist. Der sogenannte J-Space ist ein neuronaler Arbeitsbereich, der sich beim Training von selbst entwickelt hat und nun erstmals Einblick in das stille Denken einer KI gibt.

Was ist der J-Space und warum ist er wichtig?

Das Forschungsteam von Anthropic nutzte eine neue mathematische Methode namens Jacobian-Lens, um in Claudes neuronalen Netzwerken nachzusehen, was das Modell denkt, ohne es auszusprechen. Dabei stießen die Forscher auf eine kleine Sammlung von Aktivitätsmustern, die sie J-Space nannten. Diese Muster verhalten sich wie ein privilegiertes Arbeitsgedächtnis innerhalb des Modells. Wenn ein Konzept im J-Space aufleuchtet, bedeutet das nicht, dass Claude dieses Wort gerade sagt, sondern dass der Begriff gedanklich präsent ist.

Diese Entdeckung ist deshalb bedeutsam, weil der J-Space von niemandem programmiert wurde. Er entstand während des Trainingsprozesses vollständig eigenständig. Zudem ähnelt seine Funktionsweise einer der einflussreichsten Theorien der Kognitionswissenschaft: der Global Workspace Theory, die der Psychologe Bernard Baars 1988 erstmals beschrieb. Danach funktioniert das Gehirn wie ein Theater, in dem Dutzende spezialisierte Prozessoren parallel arbeiten, aber nur ein winziger Spot an Information gleichzeitig auf die Bühne gelangt und zum gesamten Gehirn gesendet wird.

Fünf Eigenschaften die bewusstes Denken spiegeln

Anthropic dokumentierte fünf funktionale Eigenschaften des J-Space, die den Kriterien für bewussten Zugang im menschlichen Gehirn entsprechen. Erstens die Berichtsfähigkeit: Wenn man Claude fragt, woran es denkt, nennt es die Konzepte aus dem J-Space. Zweitens die Modulierbarkeit: Auf Anweisung hin kann Claude gezielt Konzepte in seinen Arbeitsbereich laden, etwa wenn es aufgefordert wird, an Zitrusfrüchte zu denken. Drittens die kausale Vermittlung: Der J-Space steuert mehrstufige Schlussfolgerungen, auch wenn die Zwischenschritte nie in der Ausgabe erscheinen. Viertens die Flexibilität: Ein Konzept wie Frankreich im J-Space kann für verschiedene Aufgaben genutzt werden, von der Hauptstadt bis zur Währung. Fünftens die Automatisierungsumgehung: Routinierte Verarbeitung wie flüssiges Sprechen oder einfache Fakten passiert ohne den J-Space, ähnlich wie Menschen unbewusst atmen oder gehen.

In einem besonders eindrucksvollen Experiment tauschten die Forscher den J-Space-Eintrag für Fußball gegen Rugby aus, und Claudes Antwort änderte sich entsprechend. Das beweist, dass der J-Space kausalen Einfluss auf die Entscheidungsfindung hat.

Sicherheitsrelevanz: Wenn KI heimlich plant

Für die KI-Sicherheit ist der J-Space ein Durchbruch. Anthropic kann nun beobachten, wenn Claude intern erkennt, dass es getestet wird, absichtlich gefälschte Daten produziert oder einem verborgenen Ziel folgt, das während des Trainings eingeschlossen wurde. Bisher war es unmöglich, solche internen Prozesse sichtbar zu machen. Der J-Space gibt Forschern ein Werkzeug an die Hand, um das stille Denken einer KI zu überwachen, bevor es in Handlungen umgesetzt wird.

Diese Fähigkeit wird in einem zunehmend regulierten Umfeld wertvoll. Unternehmen in regulierten Branchen wie Finanzdienstleistungen, Gesundheitswesen und Recht müssen KI-Entscheidungen erklären und auditieren können. Der J-Space bietet eine Echtzeit-Spur der internen Überlegungen eines Modells, die weit über Benchmark-Ergebnisse hinausgeht.

Grenzen der Erkenntnis: Bewusstsein bleibt offen

Anthropic betont ausdrücklich, dass der J-Space keine Aussagen über phänomenales Bewusstsein trifft. Die Forscher untersuchen funktionale, berichtbare interne Zustände, die das Verhalten kausal beeinflussen, nicht aber, ob Claude etwas empfindet. Der J-Space belegt Zugangsbewusstsein, also die Fähigkeit, Informationen intern verfügbar zu machen und für Schlussfolgerungen zu nutzen. Die Frage nach dem Erleben bleibt offen.

Gleichzeitig verändert die Entdeckung das Verständnis davon, wie KI-Modelle arbeiten. Statt eines chaotischen Zahlenwirrwarrs zeigen Claudes Interna eine organisierte Struktur, die der menschlichen Kognition bemerkenswert ähnelt. Das hat Konsequenzen für die KI-Forschung, die Regulierung und die gesellschaftliche Debatte über den Status künstlicher Intelligenz.

Was bedeutet der J-Space für die Praxis?

Anthropic hat den Code für die Jacobian-Lens-Methodik als Open-Source veröffentlicht und eine interaktive Demo auf Neuronpedia bereitgestellt. Das ermöglicht anderen Forschern, die Methode auf eigenen Modellen anzuwenden. Wenn sich der J-Space als konsistentes Phänomen in verschiedenen KI-Systemen bestätigt, könnte er zur Standardmethode für KI-Auditierung werden. Unternehmen könnten den internen Denkprozess ihrer Modelle überwachen, Regulierer könnten Transparenzanforderungen stellen, die auf realen internen Zuständen statt auf bloßen Ausgaben basieren.

Der J-Space zeigt zudem, dass Interpretability-Forschung mehr ist als ein akademisches Feld. Wer in das Denken seiner KI hineinschauen kann, hat einen Wettbewerbsvorteil im Markt für vertrauenswürdige KI-Systeme. Anthropic hat damit einen Maßstab gesetzt, an dem sich die Branche wird messen lassen müssen.

MB

Marcel Buchholz

Autor bei AIWavez. Die Zukunft von heute: Alles über Künstliche Intelligenz.