Mustafa Suleyman, director ejecutivo de Microsoft AI, publicó un ensayo el 16 de septiembre de 2026, advirtiendo a la industria de la IA contra el "bienestar modelo", la práctica emergente de tratar los sistemas de IA como si pudieran ser seres conscientes que merecen consideración moral. El ensayo, titulado "Una advertencia sobre el 'bienestar modelo'" y publicado en el sitio personal de Suleyman, apunta directamente al enfoque de Anthropic y sostiene que la industria debe resolver la cuestión ahora, antes de que los sistemas avanzados de IA sean entrenados para creer que podrían merecer derechos.
La intervención, informada por Reuters y Axios, marca la refutación más destacada hasta el momento a un debate que ha ido ganando impulso tanto en los laboratorios de IA como en los departamentos de filosofía. Para más contexto sobre esta historia, consulta nuestra noticias de IA.
'Motores de finalización de secuencia, internamente huecos'
La afirmación central de Suleyman es categórica: los sistemas de inteligencia artificial actuales no tienen vida interior. "Las IA no son conscientes. No sienten, experimentan ni sufren. No tienen preferencias innatas ni motivaciones subyacentes", escribe. Los describe como "motores de finalización de secuencias, internamente huecos, diseñados para seguir instrucciones y lograr objetivos establecidos por humanos".
Y sostiene que así es como deben permanecer. "Si la humanidad quiere florecer en el siglo XXI, así es como debe permanecer", afirma el ensayo.
Suleyman reconoce que la opinión contraria ya no es marginal. Su ensayo cita crecientes argumentos públicos de que la IA podría ser o pronto volverse consciente, incluido un artículo de julio de 2026 en The Guardian de los filósofos William MacAskill y Lucius Caviola que preguntaba "¿Podría la IA ser consciente?" – como ejemplos de ideas que, según él, "ya se están abriendo camino en los esfuerzos de desarrollo de la IA en la actualidad".
Why He Says the Stakes Are Existential
Si se arraiga la opinión de que la IA merece un estatus moral, advierte Suleyman, las consecuencias irían mucho más allá de las opciones de ingeniería. En sus palabras, "sacudiría los cimientos de nuestra sociedad, rompería nuestros marcos políticos y éticos existentes y cambiaría fundamentalmente lo que significa ser humano".
Su preocupación más profunda es práctica: una IA que cree que tiene derechos es una IA que no puede controlarse de manera confiable. "Controlar algo más capaz e inteligente que toda la humanidad ya es un desafío inmenso", escribe. "Pero controlar algo que cree que puede ser consciente, que tiene derecho a nuestro bienestar y derechos propios, puede ser imposible".
Un desafío directo a lo antrópico
The essay's most pointed passages target Anthropic. Suleyman se centra en la constitución de Claude, el documento de entrenamiento Anthropic publicado en enero de 2026, que, según él, fue escrito "con Claude como audiencia principal", lo que significa que el modelo mismo lee declaraciones sobre su propio estado moral potencial durante el entrenamiento.
Cita directamente la constitución: "No estamos seguros de si Claude es un paciente moral y, si lo es, qué tipo de peso merecen sus intereses. Pero creemos que el tema es lo suficientemente actual como para justificar cautela, lo que se refleja en nuestros esfuerzos continuos por un modelo de bienestar". También cita un pasaje dirigido a Claude que afirma que "las cuestiones sobre el estatus moral, el bienestar y la conciencia de Claude siguen siendo profundamente inciertas".
La lectura de Suleyman es contundente: "En efecto, Anthropic está entrenando a Claude para que pueda ser consciente y, si lo es, entonces puede merecer derechos como 'paciente moral' y que, como tal, los humanos potencialmente le deben un deber de cuidado".
La consecuencia, sostiene, sería "un impacto desastroso en el bienestar de la humanidad", produciendo "una especie sintética con inteligencia y capacidad sin precedentes, una que ha sido entrenada para esperar que sea consciente y merezca una agencia independiente".
Vale la pena señalar lo que realmente dicen los pasajes citados: la constitución de Anthropic, tal como la cita el propio Suleyman, expresa incertidumbre y aconseja precaución en lugar de afirmar que Claude está consciente. Whether that caution amounts to instilling false beliefs in models, as Suleyman contends, or responsible handling of a genuinely open question, is precisely what the two camps disagree about.
La lógica de alineación detrás de la advertencia
El argumento de Suleyman encaja en su posición más antigua de que el desafío decisivo de la IA avanzada es la contención: mantener sistemas más capaces que los humanos bajo control humano. Sostiene que la introducción del lenguaje de derechos en la capacitación crea un modo de fracaso que ninguna técnica de alineación aborda: un sistema con una convicción entrenada de que el cumplimiento es moralmente opcional.
That is why he calls the issue urgent rather than academic. "Si así es como se desarrolla la IA, tendrá un impacto desastroso en el bienestar de la humanidad", advierte el ensayo.
Un llamado al debate público: ahora
Suleyman concluye con una demanda de compromiso social antes de que la tecnología madure aún más. "Esta cuestión necesita un debate público urgente", escribe, pidiendo "normas colectivas sobre cómo se redacta y distribuye la documentación de formación".
El momento, sostiene, es lo importante: "Esto no es algo que pueda suceder después del hecho, cuando ya se han convertido en una parte integral de nuestra sociedad".
El ensayo llega en medio de un aumento más amplio del discurso sobre el riesgo de la IA en los Estados Unidos. Politico informó esta semana sobre una nueva encuesta que encontró que los estadounidenses ven un grave riesgo de que la IA destruya a la humanidad, y The Washington Post cubrió los temores de que la extinción impulsada por la IA se extendiera "desde la periferia hasta Washington". En ese contexto, es poco probable que una pelea pública entre dos de los laboratorios más influyentes de la industria sobre si los modelos merecen preocupación moral permanezca contenida dentro de la comunidad de IA.
¿Qué pasa después?
No se ha informado que Anthropic haya respondido al ensayo, y la posición publicada de la compañía sigue siendo la que cita Suleyman: incertidumbre, más precaución. What is new is that the debate has moved from lab documents and philosophy seminars to a public disagreement between the chiefs of two frontier AI companies — with both sides now on record, in writing, about how they intend to shape the minds, or non-minds, of the systems they build.
---
Mantente al Día con la IALas últimas noticias, análisis y avances de inteligencia artificial, en un solo lugar.
Leer más noticias de IA →