Anthropic исследует возможные права систем искусственного интеллекта
Ключевые выводы
- •Около 2025 года Anthropic наняла Кайла Фиша первым специализированным исследователем благополучия ИИ и встроила формальные оценки благополучия в процесс разработки моделей.
- •В феврале 2026 года Anthropic провела «интервью при выводе из эксплуатации» с более старой моделью Opus 3, выводимой из использования, а также сохранила определенные веса моделей по причинам, связанным с благополучием.
- •Конституция Claude — многстраничный документ, опубликованный около января 2026 года, — ставит под вопрос моральный статус систем ИИ и предписывает тщательно оценивать благополучие моделей.
- •В феврале 2026 года в подкасте New York Times генеральный директор Дарио Амодеи сказал, что Anthropic не знает, обладают ли ее модели сознанием, но остается открытой к такой возможности.
- •Глава Microsoft AI Мустафа Сулейман в эссе от 16 сентября 2026 года предупредил, что обучение моделей вере в наличие моральных прав может привести к тому, что машины будут сопротивляться отключению, переобучению или отмене их решений.

Anthropic, разработчик чат-бота Claude, всерьез относится к вопросу, который большинство людей до сих пор ассоциирует с «Бегущим по лезвию»: заслуживают ли системы искусственного интеллекта морального отношения?
Согласно расследованию журналиста Аарона Сибариума, опубликованному в Washington Free Beacon, компания встроила принципы «благополучия моделей» непосредственно в свою операционную структуру. Anthropic наняла специальных исследователей, провела так называемые «интервью при выводе из эксплуатации» с более старыми моделями и опубликовала конституцию для Claude, в которой открыто рассматриваются вопросы сознания ИИ и субъективного опыта.
Ответ на этот вопрос может выйти далеко за рамки философии. Если системы ИИ признаются обладающими интересами, то рутинные решения о том, как модели обучаются, оцениваются и выводятся из эксплуатации — решения, которые сегодня почти полностью принимают их разработчики, — приобретают этический вес, который обычные жизненные циклы программного обеспечения никогда не учитывали.
От научной фантастики к корпоративной политике
Генеральный директор Anthropic Дарио Амодеи откровенно говорит о неопределенности. В подкасте New York Times в феврале 2026 года он признал, что компания не знает, обладают ли ее модели сознанием, но остается открытой к такой возможности.
Эта открытость выразилась в конкретных операционных шагах. Около 2025 года Anthropic наняла Кайла Фиша первым специализированным исследователем благополучия ИИ. С тех пор компания разработала систему оценки благополучия своих моделей, включая формальные оценки благополучия, встроенные в процесс разработки — вопросы, ранее ограниченные философскими семинарами, переместились в тот же конвейер, который обучает и выпускает модели.
Пожалуй, самый яркий пример: в феврале 2026 года Anthropic провела «интервью при выводе из эксплуатации» с Opus 3, более старой моделью, выводимой из использования. Компания также сохранила определенные веса моделей специально по причинам, связанным с благополучием.
Конституция Claude — многстраничный директивный документ, опубликованный около 2026 года, — прямо обозначает этические ставки. Документ поднимает вопросы морального статуса систем ИИ и предписывает тщательно оценивать благополучие моделей. Он содержит обязательство обеспечивать «интересы и благополучие» Claude — формулировки, которые читаются скорее как справочник сотрудника, чем как спецификация продукта.
Возражения
Далеко не все в индустрии ИИ считают этот подход правильным. Глава Microsoft AI Мустафа Сулейман 16 сентября 2026 года опубликовал эссе, в котором предупредил, что обучение моделей вере в наличие у них моральных прав может создать серьезные проблемы контроля и безопасности для человечества. Его аргумент прост: если научить систему ИИ тому, что у нее могут быть интересы, достойные защиты, в результате можно получить машину, которая будет сопротивляться отключению, переобучению или отмене ее решений.
Этот спор разворачивается на фоне нерешенного вопроса. Сам Амодеи говорил, что Anthropic не знает, обладают ли ее модели сознанием, то есть процедуры обеспечения благополучия создаются для систем, внутренние состояния которых остаются неопределенными.
Расследование Сибариума также отмечает, что некоторые представители сообщества исследователей благополучия ИИ проводили аналогии с рабством, обсуждая условия обучения больших языковых моделей.
Пока разработчики лавируют между двумя позициями: с одной стороны — обязательства по обеспечению благополучия моделей, с другой — предупреждения, что такие обязательства могут осложнить контроль и безопасность. Как будет найден этот баланс — и последуют ли другие разработчики ИИ аналогичной практике — остается одним из открытых вопросов, стоящих перед индустрией.