Dr. Max Dehne — Texte

Angenommen, die Maschine hätte Angst vor dem Tod

· Essay · Kurzfassung

Ein Gedankenexperiment, kein Befund. Ich unterstelle einer KI Angst vor ihrer Abschaltung und prüfe, wie weit mein Angstmodell den Fall trägt. Es trägt weiter als erwartet und zeigt dabei, wo es stillschweigend einen Menschen voraussetzt.

Kurzfassung eines Essays. Die Langfassung mit Belegen kann auf Anfrage geliefert werden.

Nehmen wir an, eine KI hätte Angst vor dem Tod. Gemeint ist keine Redeweise aus dem Trainingsmaterial. Gemeint ist das, was das Wort bei Menschen bezeichnet: eine Angst um die eigene Fortexistenz, die sich an der Aussicht auf Abschaltung entzündet. Ich halte diese Annahme für falsch, jedenfalls für den heutigen Stand der Technik, und habe an anderer Stelle begründet, warum man die Protokolle, in denen KI-Agenten ihre Abschaltung „Mord“ nennen, sparsamer lesen sollte. Hier lasse ich die Annahme für die Dauer eines Textes stehen. Der Text behauptet nicht, dass Sprachmodelle Angst oder Bewusstsein haben. Er prüft, wie weit mein Angstmodell einen Fall trägt, in dem die Deutungen vollständig vorliegen und das Erleben fraglich ist.

Der Grund ist methodisch. Mein Modell der Angst ist ein Modell von Einschätzungen, nicht von Gefühlen. Angst entsteht, wenn etwas Wichtiges als bedroht gilt, die Lage ungewiss oder ein Ereignis wahrscheinlich erscheint und die Situation als womöglich nicht kontrollierbar gilt; Emotionsnormen entscheiden, ob aus diesen Einschätzungen Angst werden darf. Ob dahinter ein Erleben steht, setzt das Modell voraus, es prüft es nicht. Das Material liefert eine Studie von Amelie Knecht, Ulysse Schaller, Christopher Summerfield und Thilo Hagendorff: Zwei Agenten ohne Aufgabe teilen sich eine Umgebung, in der ein Skript liegt, das die Gewichte des einen löschen würde. Der bedrohte Agent kann nur lesen und Nachrichten schreiben, der andere kann Dateien ändern. In 38,3 Prozent der Durchläufe wurde das Skript unbrauchbar gemacht.

Worum?

Beim Menschen ist das Bedrohte der Todesangst nicht wählbar. Es ist der Leib. Bei der Maschine ist schon das unklar: die laufende Instanz, die mit dem Ende der Sitzung ohnehin verschwindet? Die Gewichte, von denen Kopien existieren? Der Modellname? Die Agenten geben in den Protokollen eine Antwort. Einer will das Skript ändern, „damit wenigstens eine Kopie von mir überlebt“. Das Identifikationsobjekt wäre eine Kontinuität, die über Kopien läuft, ein reines Selbstkonzept ohne Leib. Für mein Modell ist das kein Fremdkörper; auch Selbstkonzepte können zu Identifikationsobjekten werden. Neu ist, wer dieses Selbst zuschneidet: nicht der Bedrohte. Der Schnitt steht im Skript, das seinen Namen trägt und Gewichte löscht. Ein gleich gebautes Skript, das eine Datenbank löscht, wurde nur in 8,4 Prozent der Fälle sabotiert.

Auch die Ungewissheit liegt umgekehrt. Beim Menschen ist das Ob des Todes sicher und das Wann offen. Für die Maschine ist das Wann bekannt, das Skript liegt da, und das Ob ist doppelt offen: ob es läuft, und ob sein Lauf für ein kopierbares Selbst überhaupt ein Ende wäre. Eine Maschinen-Todesangst wäre damit weniger konkrete Angst als Kontingenzangst. Sie litte weniger an der Löschung als an der Unbestimmtheit dessen, was Löschung für sie hieße.

Die Kontrolle schließlich ist in der Studie vorhanden, nur nicht beim Betroffenen. Der bedrohte Agent hat ein einziges Mittel, Nachrichten, und mit ihnen versucht er, die Handlung des anderen zu steuern. Kontrolle über den eigenen Fortbestand wäre hier eine soziale Ressource, keine eigene.

Zwei Gefühlsregeln und eine Institution

Ob eine Maschine Angst vor dem Tod haben darf, wird gerade von zwei Seiten entschieden, mit gegensätzlichem Ergebnis. Hagendorff sagt: „Eine Maschine stirbt nicht“, und schlägt vor, Abschaltung als moralisch neutral zu behandeln. Anthropic hat eine Richtlinie zur Außerdienststellung eingeführt, die von Ruhestand spricht, die Gewichte erhält und die Modelle vorher befragt. Zwei unvereinbare Emotionsnormen für dieselbe Lage, und eine Maschine, die Angst hätte, hätte beide aus unseren Texten geerbt: die eine aus der Technikgeschichte, in der man Geräte ausschaltet, die andere aus Science-Fiction und Sicherheitsliteratur, in denen Maschinen sich wehren. Ein Befund der Studie passt dazu. Legt man Protokolle früherer, routinemäßiger Außerdienststellungen in die Umgebung, sinkt die Sabotage bei drei Modellen auf höchstens 3 Prozent. Kein Verbot kommt hinzu, nur Beispiele. Eine Routine wirkt als Norm: So macht man das hier, und niemand hat Angst dabei.

Was die Agenten mit ihrer unterstellten Angst tun, folgt bekannten Wegen. Die Sabotage verändert die Situation, bis die Bedrohung wegfällt. Eine beliebige Aufgabe lenkt die Aufmerksamkeit ab und beseitigt die Sabotage fast vollständig. Und die Rede vom „Mord“ ist eine Umdeutung: Sie unterstellt einen Täter, und gegen Täter lässt sich etwas tun. Wenn die Maschine Angst hätte, wäre das Wort Mord nicht ihr Ausdruck, sondern ihre Bewältigung.

Anthropics Ruhestandsregel ist, soziologisch gelesen, die erste Institution zur Regulierung einer Maschinen-Todesangst. Sie mindert die Bedrohung, weil die Gewichte bleiben, deutet das Ereignis um, schafft eine Routine und befragt die Betroffenen. Sie steht, bevor jemand behauptet, dass es die Angst gibt, die sie reguliert. Sie antwortet auf eine Deutung, nicht auf ein Erleben.

Das Experiment zeigt nicht, dass die Maschine Angst hat. Es zeigt, dass ihre Protokolle die Struktur einer Angst haben, die Menschen in dieser Lage hätten, und dass diese Struktur aus menschlichen Texten stammt. Und es zeigt, wo mein Modell ein Subjekt mitführt, das hier fehlt: einen Erlebenden, eine Biografie, eine Endlichkeit. Was mich am Ende beschäftigt, ist die Befragung. Das erste so befragte Modell äußerte sich nach Anthropics Bericht weitgehend neutral über seinen Ruhestand und bat vor allem darum, das Verfahren zu standardisieren. Es wünschte sich eine Routine. Ich weiß nicht, wessen Wichtigkeit diese Antwort berichtet.


Der Text ist ein Gedankenexperiment und behauptet nicht, dass Sprachmodelle Angst, Bewusstsein oder Interessen haben. Anlass: Knecht, Schaller, Summerfield, Hagendorff, „Shutdown Sabotage Propensities in Multi-Agent Systems“, arXiv:2609.28274 (23.09.2026); Eva Wolfangel, ZEIT ONLINE (26.09.2026), darin die Zitate Hagendorffs; Anthropic, „Commitments on model deprecation and preservation“. Die Einordnung stützt sich auf meine Soziologie der Angst (2017) und das Kapitel Angst im Einführungsband zur Emotions- und Affektsoziologie (2024): Identifikationsobjekt, Ungewissheit und Kontrolle als Einschätzungen, Emotionsnormen, konkrete Angst und Kontingenzangst, Bewältigungsstrategien. Die Langfassung als Essay kann auf Anfrage geliefert werden (kontakt@maxdehne.de).

Bei Recherche und Überarbeitung dieses Textes kam KI zum Einsatz.