// SCINEXX — SPAZIO & SCIENZA
Wie bewerten Menschen das Bewusstsein künstlicher Intelligenz?
Menschen lassen sich bei der Einschätzung künstlicher Intelligenz nicht allein vom beobachteten Verhalten leiten: In Experimenten mit insgesamt 1.092 Teilnehmern galt eine stärker reagierende KI zwar als aufmerksamer. Beim eigentlichen Bewusstsein blieb jedoch eine deutliche Grenze zum Menschen bestehen, selbst wenn beide in den Szenarien dasselbe Verhalten zeigten.
München (Deutschland). Sprachmodelle und andere KI-Systeme reagieren immer menschenähnlicher. Das wirft nicht nur die Frage auf, was solche Systeme tatsächlich können, sondern auch, welche inneren Zustände Menschen ihnen zuschreiben. Gerade Begriffe wie „bewusst“ oder „aufmerksam“ können dabei sehr unterschiedlich funktionieren.
Die neue Studie untersucht deshalb nicht, ob KI wirklich ein Bewusstsein besitzt. Sie fragt vielmehr, wie Menschen identisches Verhalten bewerten, wenn es einmal von einem Menschen und einmal von einem künstlichen Akteur stammt. Damit trennt die Untersuchung die beobachtbare Reaktion eines Systems von der Art des Akteurs.
Ein Team der Ludwig-Maximilians-Universität München (LMU) um Dr. Louis Longin hat dazu Experimente mit insgesamt 1.092 Teilnehmern durchgeführt. Die Versuchspersonen lasen kurze Szenarien, in denen ein künstlicher Akteur unterschiedlich stark auf seine Umgebung reagierte, etwa auf Geräusche oder auf den emotionalen Zustand anderer. Eine Vergleichsgruppe bekam dieselben Situationen mit einem menschlichen Protagonisten vorgelegt.
Anschließend sollten die Teilnehmer einschätzen, wie bewusst oder aufmerksam der jeweilige Akteur wirkte. Je stärker Mensch oder KI auf das Geschehen reagierten, desto höher fielen grundsätzlich die Zuschreibungen aus. Doch beim Bewusstsein blieb der Akteurstyp entscheidend: Selbst die besonders reaktionsfähige KI wurde als weniger bewusst beurteilt als ein Mensch mit geringer Reaktionsfähigkeit.
Anders sah es bei der Aufmerksamkeit beziehungsweise dem im Englischen verwendeten Begriff „awareness“ aus. Hier orientierten sich die Urteile stärker am gezeigten Verhalten. Reagierte ein künstlicher Akteur sensibel auf seine Umgebung, stieg seine Bewertung ähnlich wie bei einem Menschen. Die bloße Leistung des Systems genügte also eher für die Zuschreibung von Aufmerksamkeit als für die Zuschreibung von Bewusstsein.
„Wir verwenden zwar mentale Begriffe, wenn wir über KI sprechen, aber vielleicht nur, weil wir keine passenderen Worte zur Verfügung haben“, sagt Prof. Dr. Ophelia Deroy.
Die Forscher deuten dieses Muster als Hinweis darauf, dass Menschen bei verschiedenen mentalen Begriffen unterschiedliche Maßstäbe anlegen. Bei Aufmerksamkeit scheint vor allem zu zählen, was ein Akteur tut. Beim Bewusstsein spielt dagegen zusätzlich eine grundlegende Unterscheidung zwischen Mensch und Maschine hinein. Die Studie beschreibt damit eine sogenannte essentialistische Tendenz in den Urteilen, ohne damit eine tatsächliche Eigenschaft von KI-Systemen nachzuweisen.
Das Ergebnis ist vor allem für die Sprache rund um künstliche Intelligenz relevant. Unternehmen, Medien und Nutzer beschreiben KI-Systeme häufig mit Begriffen, die sonst für menschliche Absichten oder mentale Zustände verwendet werden. Die Experimente zeigen jedoch, dass solche Wörter nicht automatisch dasselbe Urteil auslösen. Ein System kann aus Sicht der Teilnehmer aufmerksam auf seine Umgebung reagieren und trotzdem deutlich weniger bewusst erscheinen als ein Mensch.
Damit liefert die Untersuchung auch eine wichtige Grenze für ihre eigene Aussagekraft. Sie misst menschliche Zuschreibungen, nicht das tatsächliche Vorhandensein von Bewusstsein in künstlichen Systemen. Zudem beruhen die Experimente auf kurzen beschriebenen Szenarien und nicht auf längeren Live-Interaktionen mit einem konkreten Chatbot. Offen bleibt deshalb, wie stark persönliche Erfahrungen mit modernen KI-Systemen solche Urteile im Alltag verändern.