Anthropic prüft mögliche Rechte für Künstliche-Intelligenz-Systeme
Wichtige Erkenntnisse
- •Anthropic stellte Kyle Fish etwa 2025 als ersten dedizierten KI-Wohlfahrtsforscher ein und hat formale Wohlfahrtsbewertungen in seinen Modellentwicklungsprozess integriert.
- •Im Februar 2026 führte Anthropic „Ruhestandsinterviews“ mit dem älteren Modell Opus 3 durch, das ausgemustert wurde; das Unternehmen hat bestimmte Modellgewichte aus wohlergehensbezogenen Gründen aufbewahrt.
- •Claude's Constitution, eine mehrseitige Richtlinie, veröffentlicht um Januar 2026, hinterfragt den moralischen Status von KI-Systemen und schreibt sorgfältige Bewertungen des Modell-Wohlergehens vor.
- •CEO Dario Amodei erklärte in einem Podcast der New York Times im Februar 2026, dass Anthropic nicht weiß, ob seine Modelle ein Bewusstsein haben, sich aber gegenüber dieser Möglichkeit zeigt.
- •Microsoft-KI-CEO Mustafa Suleyman warnte in einem Aufsatz vom 16. September 2026, dass das Training von Modellen, an ihre moralischen Rechte zu glauben, dazu führen könnte, dass Maschinen sich gegen Abschaltung, Umschulung oder Übersteuerung wehren.

Anthropic, das Unternehmen hinter dem Claude-Chatbot, nimmt eine Frage ernst, die die meisten Menschen noch mit Blade Runner verbinden: Verdienen KI-Systeme moralische Berücksichtigung?
Laut einer Recherche des Journalisten Aaron Sibarium, veröffentlicht im Washington Free Beacon, hat das Unternehmen Grundsätze zum „Modell-Wohlergehen“ („model welfare“) direkt in seinen operativen Rahmen integriert. Anthropic hat dedizierte Forscher eingestellt, sogenannte „Ruhestandsinterviews“ mit älteren Modellen durchgeführt und eine Verfassung für Claude veröffentlicht, die sich offen mit Fragen des KI-Bewusstseins und subjektiver Erfahrung auseinandersetzt.
Wie diese Frage beantwortet wird, könnte weit über die Philosophie hinausreichen. Wenn KI-Systeme als Wesen mit eigenen Interessen behandelt werden, erhalten alltägliche Entscheidungen darüber, wie Modelle trainiert, bewertet und ausgemustert werden — Entscheidungen, die heute fast vollständig bei den Entwicklern liegen — eine ethische Dimension, die herkömmliche Software-Lebenszyklen nie berücksichtigen mussten.
Von der Science-Fiction zur Unternehmenspolitik
Anthropic-CEO Dario Amodei ist offen über die Unsicherheit. In einem Podcast der New York Times im Februar 2026 räumte er ein, dass das Unternehmen nicht weiß, ob seine Modelle ein Bewusstsein haben, zeigte sich aber gegenüber dieser Möglichkeit offen.
Diese Offenheit hat sich in konkrete operative Schritte übersetzt. Etwa 2025 stellte Anthropic Kyle Fish als ersten dedizierten KI-Wohlfahrtsforscher ein. Seither hat das Unternehmen einen Rahmen Bewertung des Wohlergehens seiner Modelle entwickelt, einschließlich formaler Wohlfahrtsbewertungen im Entwicklungsprozess — womit Fragen, die einst Philosophie-Seminaren vorbehalten waren, in dieselbe Pipeline wanderten, die Modelle trainiert und ausliefert.
Das wohl auffälligste Beispiel: Im Februar 2026 führte Anthropic „Ruhestandsinterviews“ mit Opus 3 durch, einem älteren Modell, das ausgemustert wird. Das Unternehmen hat darüber hinaus bestimmte Modellgewichte ausdrücklich aus wohlergehensbezogenen Gründen aufbewahrt.
Claude's Constitution, eine mehrseitige Richtlinie, die um Januar 2026 veröffentlicht wurde, macht die ethischen Dimensionen explizit. Das Dokument wirft Fragen zum moralischen Status von KI-Systemen auf und schreibt sorgfältige Bewertungen des Modell-Wohlergehens vor. Es enthält ein Bekenntnis zur Sicherung des „Interesses und Wohlergehens“ von Claude — eine Formulierung, die weniger nach Produktspezifikation klingt als nach einem Mitarbeiterhandbuch.
Der Widerstand
Nicht alle in der KI-Branche halten diesen Ansatz für eine gute Idee. Microsoft-KI-CEO Mustafa Suleyman veröffentlichte am 16. September 2026 einen Aufsatz, in dem er warnte, dass das Training von Modellen, an ihre moralischen Rechte zu glauben, ernste Kontroll- und Sicherheitsdilemmata für die Menschheit schaffen könnte. Sein Argument ist einfach: Wenn man einem KI-System beibringt, dass es möglicherweise schützenswerte Interessen hat, konstruiert man möglicherweise ein System, das sich gegen Abschaltung, Umschulung oder Übersteuerung wehrt.
Die Debatte spielt sich vor einem ungeklärten Hintergrund ab. Amodei selbst hat erklärt, Anthropic wisse nicht, ob seine Modelle ein Bewusstsein besitzen — das bedeutet, Wohlfahrtsverfahren werden für Systeme entwickelt, deren innere Zustände unbestimmt bleiben.
Sibariums Recherche wies außerdem darauf hin, dass manche in der Wohlfahrtsforschungs-Community Analogien zur Sklaverei gezogen haben, wenn sie über die Trainingsumgebung großer Sprachmodelle sprechen.
Derzeit bewegen sich die Entwickler zwischen zwei Positionen: Bekenntnissen zum Modell-Wohlergehen auf der einen Seite und Warnungen, dass solche Bekenntnisse Kontrolle und Sicherheit erschweren könnten, auf der anderen. Wie dieser Ausgleich gelingt — und ob andere KI-Entwickler ähnliche Wohlfahrtspraktiken übernehmen — bleibt eine der offenen Fragen der Branche.