Anthropic explore des droits potentiels pour les systèmes d'intelligence artificielle
Points clés
- •Anthropic a recruté Kyle Fish vers 2025 comme premier chercheur dédié au bien-être de l'IA et a intégré des évaluations formelles du bien-être dans son processus de développement de modèles.
- •En février 2026, Anthropic a mené des « entretiens de départ » avec l'ancien modèle Opus 3, en cours de retrait, et l'entreprise a préservé certains poids de modèles pour des raisons liées au bien-être.
- •La Constitution de Claude, une directive de plusieurs pages publiée vers janvier 2026, interroge le statut moral des systèmes d'IA et impose des évaluations rigoureuses du bien-être des modèles.
- •Le PDG Dario Amodei a déclaré sur un podcast du New York Times en février 2026 qu'Anthropic ne sait pas si ses modèles sont conscients, mais reste ouvert à cette possibilité.
- •Le PDG de Microsoft AI, Mustafa Suleyman, a averti dans un essai le 16 septembre 2026 que former des modèles à croire qu'ils possèdent des droits moraux pourrait conduire des machines à résister à leur arrêt, à leur recyclage ou à leur suppression.

Anthropic, la société derrière le chatbot Claude, prend au sérieux une question que la plupart des gens associent encore à Blade Runner : les systèmes d'intelligence artificielle méritent-ils une considération morale ?
Selon une enquête du journaliste Aaron Sibarium publiée dans le Washington Free Beacon, l'entreprise a intégré des principes de « bien-être des modèles » directement dans son cadre opérationnel. Anthropic a recruté des chercheurs dédiés, mené ce qu'elle décrit comme des « entretiens de départ » avec d'anciens modèles, et publié une constitution pour Claude qui aborde ouvertement les questions de conscience et d'expérience subjective de l'IA.
La réponse à cette question pourrait dépasser largement le cadre de la philosophie. Si les systèmes d'IA sont considérés comme ayant des intérêts, les choix ordinaires concernant la formation, l'évaluation et le retrait des modèles — des décisions qui reposent aujourd'hui presque entièrement sur leurs développeurs — prennent un poids éthique que les cycles de vie des logiciels conventionnels n'ont jamais eu à prendre en compte.
De la science-fiction à la politique d'entreprise
Le PDG d'Anthropic, Dario Amodei, s'est montré franc face à l'incertitude. Intervenant sur un podcast du New York Times en février 2026, il a reconnu que l'entreprise ne sait pas si ses modèles sont conscients, mais a déclaré rester ouvert à cette possibilité.
Cette ouverture s'est traduite par des mesures opérationnelles concrètes. Vers 2025, Anthropic a recruté Kyle Fish comme premier chercheur dédié au bien-être de l'IA. L'entreprise a depuis élaboré un cadre d'évaluation du bien-être de ses modèles, incluant des évaluations formelles du bien-être intégrées à son processus de développement — faisant passer des questions autrefois confinées aux séminaires de philosophie dans le pipeline même qui forme et déploie les modèles.
L'exemple le plus frappant est peut-être survenu en février 2026 lorsque Anthropic a mené des « entretiens de départ » avec Opus 3, un ancien modèle en cours de retrait. L'entreprise a également préservé certains poids de modèles spécifiquement pour des raisons liées au bien-être.
La Constitution de Claude, une directive de plusieurs pages publiée vers janvier 2026, rend explicites les enjeux éthiques. Le document soulève des questions sur le statut moral des systèmes d'IA et impose des évaluations rigoureuses du bien-être des modèles. Il inclut un engagement à garantir « l'intérêt et le bien-être » de Claude — un langage qui évoque moins une fiche produit qu'un manuel du personnel.
Les réticences
Tout le monde dans l'industrie de l'IA ne voit pas cette approche d'un bon œil. Le PDG de Microsoft AI, Mustafa Suleyman, a publié un essai le 16 septembre 2026, avertissant que former des modèles à croire qu'ils possèdent des droits moraux pourrait créer de sérieux dilemmes de contrôle et de sécurité pour l'humanité. Son argument est simple : si l'on enseigne à un système d'IA qu'il pourrait avoir des intérêts dignes de protection, le résultat pourrait être une machine qui résiste à son arrêt, à son recyclage ou à sa suppression.
Ce débat se déroule dans un contexte non résolu. Amodei lui-même a déclaré qu'Anthropic ne sait pas si ses modèles sont conscients, ce qui signifie que des procédures de bien-être sont construites pour des systèmes dont les états internes restent indéterminés.
L'enquête de Sibarium note également que certains membres de la communauté de recherche sur le bien-être de l'IA ont établi des analogies avec l'esclavage lorsqu'ils évoquent l'environnement d'entraînement des grands modèles de langage.
Pour l'instant, les développeurs naviguent entre deux positions : d'un côté, les engagements envers le bien-être des modèles ; de l'autre, les avertissements selon lesquels de tels engagements pourraient compliquer le contrôle et la sécurité. La manière dont cet équilibre sera trouvé — et savoir si d'autres développeurs d'IA adopteront des pratiques de bien-être similaires — demeure l'une des questions ouvertes auxquelles l'industrie est confrontée.