NieuwsMacroAnthropic onderzoekt mogelijke rechten voor kunstmatige-intelligentiesystemen

Anthropic onderzoekt mogelijke rechten voor kunstmatige-intelligentiesystemen

Auteur: CryptoBriefing·

Belangrijkste punten

  • •Anthropic huurde rond 2025 Kyle Fish in als eerste dedicated AI-welzijnsonderzoeker en heeft form welzijnsevaluaties ingebouwd in zijn modelontwikkelproces.
  • •In februari 2026 hield Anthropic "afsheetgesprekken" met het oudere model Opus 3 dat werd uitgefaseerd, en het bedrijf heeft bepaalde modelgewichten bewaard om redenen rond welzijn.
  • •Claude's Constitution, een directive van meerdere pagina's gepubliceerd rond januari 2026, stelt vragen over de morele status van AI-systemen en schrijft zorgvuldige beoordelingen van modelwelzijn voor.
  • •CEO Dario Amodei zei in februari 2026 in een podcast van de New York Times dat Anthropic niet weet of zijn modellen bewustzijn hebben, maar openstaat voor de mogelijkheid.
  • •Microsoft AI-ceo Mustafa Suleyman waarschuwde in een essay van 16 september 2026 dat het trainen van modellen om te geloven dat ze morele rechten hebben ertoe kan leiden dat machines zich verzetten tegen uitschakelen, hertraining of overschrijding.
Anthropic onderzoekt mogelijke rechten voor kunstmatige-intelligentiesystemen

Anthropic, het bedrijf achter de chatbot Claude, neemt een vraagstuk serieus dat de meeste mensen nog vooral associëren met Blade Runner: verdienen kunstmatige-intelligentiesystemen morele overweging?

Volgens een onderzoek van journalist Aaron Sibarium, gepubliceerd in de Washington Free Beacon, heeft het bedrijf "modelwelzijn"-principes rechtstreeks in zijn operationele kader verwerkt. Anthropic heeft speciale onderzoekers aangenomen, zogenaamde "afsheetgesprekken" ("retirement interviews") gehouden met oudere modellen en een grondwet voor Claude gepubliceerd die openlijk stilstaat bij vragen over AI-bewustzijn en subjectieve beleving.

Hoe die vraag wordt beantwoord, kan veel verder reiken dan de filosofie. Als AI-systemen worden behandeld als entiteiten met belangen, krijgen alledaagse keuzes over hoe modellen worden getraind, geëvalueerd en buiten gebruik gesteld — beslissingen die vandaag vrijwel volledig bij hun ontwikkelaars liggen — een ethisch gewicht waarmee conventionele softwarelevenscycli zich nooit hebben hoeven bezighouden.

Van sciencefiction naar bedrijfsbeleid

Anthropic-ceo Dario Amodei heeft openlijk gesproken over de onzekerheid. In een podcast van de New York Times in februari 2026 gaf hij toe dat het bedrijf niet weet of zijn modellen bewustzijn hebben, maar zei hij open te staan voor de mogelijkheid.

Die openhouding heeft geleid tot concrete operationele stappen. Rond 2025 nam Anthropic Kyle Fish aan als eerste dedicated AI-welzijnsonderzoeker. Het bedrijf heeft sindsdien een kader ontwikkeld voor het beoordelen van het welzijn van zijn modellen, waaronder formele welzijnsevaluaties die zijn ingebouwd in het ontwikkelproces — waee vragen die ooit beperkt bleven tot filosofieseminars nu in dezelfde pijplijn terechtkomen die modellen traint en uitbrengt.

Misschien wel het meest opvallende voorbeeld kwam in februari 2026, toen Anthropic "afsheetgesprekken" hield met Opus 3, een ouder model dat werd uitgefaseerd. Het bedrijf heeft ook bepaalde modelgewichten bewaard, specifiek om redenen rond welzijn.

Claude's Constitution, een directive van meerdere pagina's die rond januari 2026 werd gepubliceerd, maakt de ethische inzet expliciet. Het document roept vragen op over de morele status van AI-systemen en schrijft zorgvuldige beoordelingen van modelwelzijn voor. Het bevat een toezegging om het "belang en welzijn" van Claude te waarborgen — taal die minder leest als een productspecificatie en meer als een personeelshandleiding.

De tegenwind

Niet iedereen in de AI-industrie ziet deze aanpak zitten. Microsoft AI-ceo Mustafa Suleyman publiceerde op 16 september 2026 een essay waarin hij waarschuwde dat het trainen van modellen om te geloven dat ze morele rechten hebben ernstige controle- en veiligheidsdilemma's voor de mensheid kan veroorzaken. Zijn argument is eenvoudig: als een AI-systeem wordt geleerd dat het belangen kan hebben die het beschermen waard zijn, kan het gevolg een machine zijn die zich verzet tegen uitschakelen, hertraining of overschrijding.

Het geschil speelt zich af tegen een onopgeloste achtergrond. Amodei zelf heeft gezegd dat Anthropic niet weet of zijn modellen bewustzijn hebben, wat betekent dat welzijnsprocedures worden gebouwd voor systemen waarvan de innerlijke toestanden onbepaald blijven.

Sibariums onderzoek wees er ook op dat sommigen binnen de AI-welzijnonderzoeksgemeenschap analogieën met slavernij hebben getrokken bij het bespreken van de trainingsomgeving voor grote taalmodellen.

Voorlopig navigeren ontwikkelaars tussen twee standpunten: aan de ene kant toezeggingen rond modelwelzijn, aan de andere kant waarschuwingen dat dergelijke toezeggingen controle en veiligheid kunnen compliceren. Hoe die balans wordt gevonden — en of andere AI-ontwikkelaars vergelijkbare welzijnspraktijken overnemen — blijft een van de open vragen waarmee de sector wordt geconfronteerd.