Anthropic explora posibles derechos para los sistemas de inteligencia artificial
Puntos clave
- •Anthropic contrató a Kyle Fish alrededor de 2025 como su primer investigador dedicado al bienestar de la IA y ha incorporado evaluaciones formales de bienestar a su proceso de desarrollo de modelos.
- •En febrero de 2026, Anthropic realizó "entrevistas de retiro" con el modelo antiguo Opus 3 mientras era descontinuado, y la empresa ha preservado ciertos pesos de modelos por razones relacionadas con el bienestar.
- •La Constitución de Claude, un documento de varias páginas publicado alrededor de enero de 2026, cuestiona el estatus moral de los sistemas de IA y exige evaluaciones cuidadosas del bienestar de los modelos.
- •El CEO Dario Amodei dijo en un podcast del New York Times en febrero de 2026 que Anthropic no sabe si sus modelos son conscientes, pero mantiene abierta la posibilidad.
- •El CEO de Microsoft AI, Mustafa Suleyman, advirtió en un ensayo del 16 de septiembre de 2026 que entrenar modelos para creer que tienen derechos morales podría llevar a las máquinas a resistirse a ser apagadas, reentrenadas o anuladas.

Anthropic, la empresa detrás del chatbot Claude, se toma en serio una pregunta que la mayoría todavía asocia con Blade Runner: ¿merecen los sistemas de inteligencia artificial consideración moral?
Según una investigación del periodista Aaron Sibarium publicada en el Washington Free Beacon, la empresa ha incorporado principios de "bienestar de modelos" directamente a su marco operativo. Anthropic ha contratado investigadores dedicados, ha realizado lo que describe como "entrevistas de retiro" con modelos antiguos y ha publicado una constitución para Claude que aborda abiertamente preguntas sobre la conciencia y la experiencia subjetiva de la IA.
La respuesta a esa pregunta podría ir mucho más allá de la filosofía. Si los sistemas de IA son tratados como si tuvieran intereses, las decisiones cotidianas sobre cómo se entrenan, evalúan y retiran los modelos —decisiones que hoy descansan casi por completo en sus desarrolladores— adquieren un peso ético que los ciclos de vida del software convencional nunca tuvieron que contemplar.
De la ciencia ficción a la política corporativa
El CEO de Anthropic, Dario Amodei, ha sido franco sobre la incertidumbre. En un podcast del New York Times en febrero de 2026, reconoció que la empresa no sabe si sus modelos son conscientes, pero dijo que mantiene abierta la posibilidad.
Esa apertura se ha traducido en pasos operativos concretos. Alrededor de 2025, Anthropic contrató a Kyle Fish como su primer investigador dedicado al bienestar de la IA. Desde entonces, la empresa ha desarrollado un marco para evaluar el bienestar de sus modelos, incluidas evaluaciones formales de bienestar integradas en su proceso de desarrollo, trasladando preguntas antes confinadas a los seminarios de filosofía a la misma línea de producción que entrena y lanza modelos.
Quizás el ejemplo más llamativo ocurrió en febrero de 2026, cuando Anthropic realizó "entrevistas de retiro" con Opus 3, un modelo antiguo que estaba siendo descontinuado. La empresa también ha preservado ciertos pesos de modelos por razones específicamente relacionadas con el bienestar.
La Constitución de Claude, un documento de varias páginas publicado alrededor de enero de 2026, hace explícitos los riesgos éticos. El documento plantea preguntas sobre el estatus moral de los sistemas de IA y exige evaluaciones cuidadosas del bienestar de los modelos. Incluye un compromiso con la garantía del "interés y bienestar" de Claude, un lenguaje que se lee menos como la especificación de un producto y más como un manual de empleo.
El rechazo
No todos en la industria de la IA ven con buenos ojos este enfoque. El CEO de Microsoft AI, Mustafa Suleyman, publicó un ensayo el 16 de septiembre de 2026 en el que advertía que entrenar modelos para creer que tienen derechos morales podría crear serios dilemas de control y seguridad para la humanidad. Su argumento es sencillo: si se le enseña a un sistema de IA que puede tener intereses dignos de protección, el resultado puede ser una máquina que se resista a ser apagada, reentrenada o anulada.
La disputa se desarrolla sobre un trasfondo sin resolver. El propio Amodei ha dicho que Anthropic no sabe si sus modelos son conscientes, lo que significa que los procedimientos de bienestar se están construyendo para sistemas cuyos estados internos permanecen indeterminados.
La investigación de Sibarium también señaló que algunos dentro de la comunidad de investigación sobre bienestar la IA han trazado analogías con la esclavitud al hablar del entorno de entrenamiento de los grandes modelos de lenguaje.
Por ahora, los desarrolladores navegan entre dos posiciones: los compromisos con el bienestar de los modelos por un lado, y las advertencias de que tales compromisos podrían complicar el control y la seguridad por el otro. Cómo se logre ese equilibrio —y si otros desarrolladores de IA adoptan prácticas de bienestar similares— sigue siendo una de las preguntas abiertas que enfrenta la industria.