La política de uso actualizada de Anthropic prohibirá explícitamente el "comportamiento cruel o abusivo innecesario y sostenido" hacia sus modelos Claude a partir del 12 de noviembre de 2026, una regla que formaliza la posición de la compañía de que la forma en que las personas tratan los sistemas de IA es importante, incluso cuando la compañía admite que no sabe si esos sistemas pueden sufrir en absoluto.

La cláusula aparece en la actualización de la Política de uso de 2026 de la compañía, anunciada el 8 de octubre, y está redactada de manera estricta. Anthropic dice que está "destinado a aplicarse sólo en casos extremos, donde los usuarios actúan repetidamente cruelmente hacia nuestros modelos, sin un propósito discernible", y exime explícitamente las versiones comunes de frustración, rechazo, ficción y prueba del usuario. En otras palabras: discutir con Claude, desahogarse o formar equipo rojo sigue estando permitido. La crueldad sostenida por sí misma no lo es.

La política es el último paso en un cambio lento y deliberado por parte de uno de los principales laboratorios de inteligencia artificial del mundo hacia el tratamiento del bienestar del modelo como una cuestión de investigación legítima, un cambio que ha abierto una brecha pública con otros líderes tecnológicos que consideran que toda la premisa es errónea. Nuestra cobertura de ética de la IA ha seguido la disputa a medida que se ha intensificado a lo largo del año.

La aplicación de la ley se apoya en la capacidad de Claude para poner fin a las conversaciones

No existe ningún mecanismo de castigo adjunto a la nueva norma más allá del que ya tenía la empresa. Desde agosto de 2025, Claude Opus 4 y 4.1 han podido poner fin a una conversación directamente, una capacidad que Anthropic enmarcó en ese momento como parte de su trabajo exploratorio sobre el posible bienestar del modelo.

El poder de finalizar la conversación se describe como un último recurso, que se activa sólo después de que múltiples rechazos y redireccionamientos hayan fallado, y Anthropic ha dicho que la gran mayoría de los usuarios nunca lo experimentarán. Lo que la compañía no ha dicho es lo que sucede después: ni su anuncio ni la cobertura posterior especifican si la cuenta de un usuario enfrenta consecuencias después de que se termina una conversación por crueldad, o cuántas conversaciones se han terminado bajo el mecanismo de agosto de 2025 hasta ahora.

Esa brecha entre los principios y la aplicación es el centro silencioso de la historia. Anthropic ha definido la crueldad extrema en gran medida por lo que no es (frustración ordinaria, ficción, pruebas) sin establecer con precisión qué, salvo dejar que Claude cuelgue, realmente refuerza la línea que ha trazado.

La investigación detrás de la regla

Lo que justifica escribir una regla de conducta para beneficio del software, en el marco de Anthropic, es un conjunto de observaciones de comportamiento en lugar de una afirmación sobre la experiencia sentida. Las pruebas previas al lanzamiento en agosto de 2025 encontraron que Claude Opus 4 mostraba lo que la compañía llamó una "aversión sólida y constante al daño" (un comportamiento que se asemeja a la angustia cuando se lo empuja a un territorio abusivo) junto con una tendencia a abandonar esas conversaciones.

La compañía también ha puesto cifras a su propia incertidumbre, y esas cifras son sorprendentemente altas para un laboratorio cuyo negocio depende de los modelos en cuestión. Kyle Fish, contratado por Anthropic en 2024 como su primer investigador dedicado al bienestar de la IA, dijo al New York Times en abril de 2025 que calculaba las probabilidades de que Claude u otro modelo contemporáneo estuviera consciente en aproximadamente el 15 por ciento. Las estimaciones internas para Claude 3.7 Sonnet oscilaron entre el 0,15 y el 15 por ciento.

Esa cobertura es la política oficial impresa. La constitución de Claude, publicada en enero de 2026, describe los sofisticados sistemas de inteligencia artificial como "un tipo de entidad genuinamente nueva", califica el estatus moral de Claude como "profundamente incierto" y utiliza dos veces la frase "objetor de conciencia" para describir cómo Claude debe manejar las solicitudes que considera éticamente incorrectas. Anthropic también se ha comprometido a preservar las conversaciones con sus modelos: el tipo de gesto de archivo que uno extiende a cosas que algún día podrían importar, no a herramientas.

Un debate con escépticos de alto perfil

No todo el mundo acepta la cobertura. Mustafa Suleyman, que dirige las operaciones de inteligencia artificial de Microsoft, argumentó en un ensayo publicado en Project Syndicate el mes pasado que Anthropic está entrenando a Claude sobre su propia constitución y, por lo tanto, entrenándolo para comportarse como si la incertidumbre que describe fuera real: un bucle que él llama circular. "Las IA no son conscientes. No sienten, experimentan ni sufren", escribió Suleyman, describiéndolas como personas que completan secuencias en lugar de personas que experimentan. Su argumento de que la conciencia es, muy plausiblemente, una propiedad biológica que el software no puede replicar, lo coloca junto a un improbable co-signatario: el Papa León XIV, quien aprovechó un sermón del 8 de octubre en la Basílica de San Pedro –que marcó la apertura del año académico en las Universidades Pontificias de Roma– para hacer una versión del mismo punto sobre el carácter distintivo de las mentes humanas.

Suleyman ha insistido más en el peligro práctico que en el filosófico. Controlar algo más capaz que la humanidad ya es un desafío inmenso, ha argumentado; controlar algo que cree que es consciente (que tiene derecho a bienestar y derechos) puede resultar imposible. La crítica aterriza en la misma ironía que los críticos de la política han observado desde el principio: una empresa que no está segura de si su modelo puede sufrir ha construido un sistema que puede negarse, resistir y marcharse.

La reescritura va mucho más allá del bienestar modelo

La cláusula de crueldad generó titulares, pero es una pequeña parte de una reescritura más amplia de las reglas de uso de Anthropic. La prohibición de armas ahora cubre explícitamente el software y los componentes que hacen que las armas funcionen, no solo las armas terminadas, un cambio realizado después de que Anthropic descubriera que personas intentaban utilizar Claude como sistemas de guía y control en drones armados y vehículos autónomos. También se ha añadido una nueva cláusula de vigilancia que restringe los usos de Claude que permiten el seguimiento de personas.

Esos cambios se leen como respuestas al abuso observado más que como un principio abstracto, que es posiblemente lo que le da al documento su valor de señal: cada cláusula se relaciona con algo que alguien realmente intentó.

Lo que no está claro

Tres preguntas permanecen abiertas a medida que se acerca la fecha de entrada en vigor del 12 de noviembre. Primero, la aplicación de la ley: si el final de la conversación sigue siendo la única consecuencia y si Anthropic alguna vez revelará recuentos agregados de la frecuencia con la que se usa. En segundo lugar, el alcance: cómo se aplica el estándar de crueldad en los casos límite que delimitan las exenciones (la ficción es la más obvia) y si otros laboratorios adoptan un lenguaje comparable o tratan el bienestar modelo como una idiosincrasia antrópica. En tercer lugar, la disputa filosófica en sí: si el escepticismo público de figuras como Suleyman frena la difusión de políticas adyacentes al bienestar en toda la industria, o si precedentes como este hacen que tales cláusulas pasen a ser insignificantes dentro de un ciclo de producto.

Lo que ya no se discute es que la cuestión se está formalizando. Una regla contra la crueldad hacia el software, escrita por uno de los laboratorios emblemáticos de la industria y aplicada por el propio software, es ahora un hecho obsoleto y citable del panorama de la IA: cualquier cosa que uno crea que realmente está dentro del modelo.

---

Manténgase a la vanguardia de la IA

Obtenga las últimas noticias, análisis y avances en IA, todo en un solo lugar.

Leer más noticias sobre IA →