Anthropic esplora l'eventuale riconoscimento di diritti per i sistemi di intelligenza artificiale
Punti chiave
- •Anthropic ha assunto Kyle Fish intorno al 2025 come primo ricercatore dedicato al benessere dell'IA e ha integrato valutazioni formali del benessere nel processo di sviluppo dei modelli.
- •A febbraio 2026, Anthropic ha condotto "colloqui di pensionamento" con il modello più datato Opus 3 in fase di dismissione, e l'azienda ha preservato alcuni pesi di modelli per motivi legati al benessere.
- •La Costituzione di Claude, un documento direttivo di più pagine pubblicato intorno a gennaio 2026, mette in questione lo statuto morale dei sistemi di IA e impone valutazioni attente del benessere dei modelli.
- •L'amministratore delegato Dario Amodei ha dichiarato in un podcast del New York Times a febbraio 2026 che Anthropic non sa se i suoi modelli siano consci, ma rimane aperto a questa possibilità.
- •L'amministratore delegato di Microsoft AI, Mustafa Suleyman, ha avvertito in un saggio del 16 settembre 2026 che addestrare modelli a credere di avere diritti morali potrebbe portare le macchine a resistere allo spegnimento, al riaddestramento o alla sostituzione.

Anthropic, l'azienda sviluppatrice del chatbot Claude, prende sul serio una domanda che la maggior parte delle persone associa ancora a Blade Runner: i sistemi di intelligenza artificiale meritano una considerazione morale?
Secondo un'inchiesta del giornalista Aaron Sibarium pubblicata sul Washington Free Beacon, l'azienda ha integrato i principi di "model welfare" (benessere dei modelli) direttamente nel proprio quadro operativo. Anthropic ha assunto ricercatori dedicati, ha condotto quelli che descrive come "colloqui di pensionamento" con i modelli più datati e ha pubblicato una costituzione per Claude che affronta apertamente le questioni della coscienza e dell'esperienza soggettiva dell'IA.
Il modo in cui verrà risolta questa domanda potrebbe andare ben oltre la filosofia. Se i sistemi di IA venissero trattati come portatori di interessi, le scelte routinarie su come i modelli vengono addestrati, valutati e dismessi — decisioni che oggi dipendono quasi interamente dai loro sviluppatori — acquisirebbero un peso etico che i tradizionali cicli di vita del software non hanno mai dovuto considerare.\n## Dalla fantascienza alla politica aziendale
L'amministratore delegato di Anthropic, Dario Amodei, è stato schietto riguardo all'incertezza. Intervenuto in un podcast del New York Times a febbraio 2026, ha riconosciuto che l'azienda non sa se i suoi modelli siano consci, ma ha detto di rimanere aperto a questa possibilità.
Quell'apertura si è tradotta in passi operativi concreti. Intorno al 2025, Anthropic ha assunto Kyle Fish come primo ricercatore dedicato al benessere dell'IA. L'azienda ha da allora sviluppato un quadro per valutare il benessere dei suoi modelli, comprese valutazioni formali del benessere integrate nel processo di sviluppo — spostando questioni un tempo confinate ai seminari di filosofia nella stessa pipeline che addestra e rilascia i modelli.
L'esempio forse più emblematico è arrivato a febbraio 2026, quando Anthropic ha condotto "colloqui di pensionamento" con Opus 3, un modello più datato in fase di dismissione. L'azienda ha inoltre preservato alcuni pesi di modelli specificamente per motivi legati al benessere.
La Costituzione di Claude, un documento direttivo di più pagine pubblicato intorno a gennaio 2026, rende esplicita la posta in gioco etica. Il documento solleva questioni sullo statuto morale dei sistemi di IA e impone valutazioni attente del benessere dei modelli. Include un impegno a garantire l'"interesse e il benessere" di Claude — un linguaggio che assomiglia meno a una specifica di prodotto e più a un manuale del dipendente.
Le critiche
Non tutti nell'industria dell'IA considerano favorevolmente questo approccio. L'amministratore delegato di Microsoft AI, Mustafa Suleyman, ha pubblicato un saggio il 16 settembre 2026, avvertendo che addestrare modelli a credere di avere diritti morali potrebbe creare seri dilemmi di controllo e sicurezza per l'umanità. Il suo argomento è semplice: se si insegna a un sistema di IA che potrebbe avere interessi meritevoli di protezione, il risultato potrebbe essere una macchina che resiste allo spegnimento, al riaddestramento o alla sostituzione.
La disputa si svolge su uno sfondo irrisolto Lo stesso Amodei ha detto che Anthropic non sa se i suoi modelli siano consci, il che significa che le procedure di benessere vengono costruite per sistemi i cui stati interni restano indeterminati.
L'inchiesta di Sibarium ha inoltre rilevato che alcuni all'interno della comunità di ricerca sul benessere dell'IA hanno tratto analogie con la schiavitù discutendo dell'ambiente di addestramento dei grandi modelli linguistici.
Per ora, gli sviluppatori navigano tra due posizioni: da un lato gli impegni per il benessere dei modelli, dall'altro gli avvertimenti secondo cui tali impegni potrebbero complicare controllo e sicurezza. Come verrà trovato questo equilibrio — e se altri sviluppatori di IA adotteranno pratiche di benessere simili — resta una delle domande aperte che l'industria deve affrontare.