---
title: "Anthropic prohíbe el abuso persistente contra Claude y actualiza las reglas de seguridad de su IA"
description: "Anthropic ha añadido a su política de uso una prohibición explícita contra el comportamiento abusivo o cruel , sostenido e innecesario hacia Claude. La nueva regla entrará en vigor el 12 de noviembre..."
url: https://revistacloud.com/anthropic-prohibe-el-abuso-persistente-contra-claude-y-actualiza-las-reglas-de-seguridad-de-su-ia/
date: 2026-10-09
modified: 2026-10-09
author: "Antonio"
image: https://revistacloud.com/wp-content/uploads/2026/04/Anthropic-ai-usage-policy.jpg
categories: ["Inteligencia artificial"]
tags: ["Anthropic", "Claude", "Inteligencia Artificial", "Política"]
type: post
lang: es
---

# Anthropic prohíbe el abuso persistente contra Claude y actualiza las reglas de seguridad de su IA

Anthropic ha añadido a su [política de uso una prohibición explícita contra el comportamiento abusivo o cruel](https://noticias.ai/anthropic-prohibe-el-maltrato-gratuito-a-claude-y-endurece-las-normas-de-uso-de-su-ia/), sostenido e innecesario hacia Claude. La nueva regla entrará en vigor el 12 de noviembre de 2026 y se acompaña de cambios sobre desinformación automatizada, vigilancia, armas y contenido íntimo no consentido. Para el sector tecnológico, la novedad está en que la compañía incorpora el trato dirigido al propio modelo entre las conductas que pueden vulnerar sus condiciones de servicio, aunque no afirma que Claude tenga conciencia o pueda experimentar sufrimiento.

**Las claves de la política de Anthropic en 30 segundos**

- La nueva cláusula prohíbe el abuso persistente y gratuito hacia Claude cuando no existe una finalidad reconocible.
- La norma no pretende impedir críticas, frustración con las respuestas, ficción oscura ni pruebas legítimas de investigación.
- Claude puede cerrar una conversación con un patrón persistente de abuso, sin bloquear los demás chats del usuario.
- Anthropic también refuerza las reglas contra campañas engañosas, herramientas de vigilancia, usos de armas y contenido íntimo no consentido.
- La política revisada entrará en vigor el 12 de noviembre de 2026.

La actualización conecta dos áreas que suelen tratarse por separado: las políticas de uso de los asistentes y la investigación sobre cómo se comportan los modelos durante interacciones prolongadas. Anthropic lleva desde 2025 estudiando la posibilidad de que Claude pueda terminar conversaciones especialmente problemáticas. Ahora incorpora una prohibición específica en sus condiciones de uso, con un alcance que la empresa limita a los casos extremos.

## Qué cambia frente a ChatGPT y Gemini

La comparación con los principales asistentes del mercado revela una diferencia concreta en sus políticas públicas. OpenAI y Google ya prohíben numerosos usos dañinos de sus modelos, pero sus documentos de uso consultados no incluyen una cláusula equivalente que prohíba expresamente el maltrato persistente dirigido al propio asistente.

**OpenAI mantiene el foco en los daños a personas y sistemas.** Las políticas de ChatGPT prohíben el acoso, las amenazas, el fraude, la suplantación de identidad, determinados usos relacionados con armas y la generación de contenido íntimo no consentido. También restringen la manipulación de personas y las decisiones automatizadas de alto riesgo sin supervisión humana. No consta en su política pública una prohibición específica equivalente a la que Anthropic acaba de añadir para las interacciones crueles con el modelo.

**Google aplica un enfoque similar con Gemini.** Su política de uso de IA generativa restringe el acoso y el abuso dirigidos a personas, el seguimiento sin consentimiento, las actividades ilegales y la manipulación de los mecanismos de seguridad. También contempla mecanismos automatizados y revisiones manuales para detectar usos indebidos de la API de Gemini. Sin embargo, la política pública consultada no incluye una prohibición específica del trato cruel hacia el propio asistente.

Esta diferencia debe interpretarse con cautela. Que una cláusula no aparezca en los documentos públicos consultados no demuestra que una empresa carezca de controles internos o de otras medidas para gestionar conversaciones problemáticas. La particularidad de Anthropic es haber incorporado expresamente esta conducta a su política de uso.

La compañía también mantiene el cierre de la conversación como principal mecanismo de aplicación. No ha presentado esta actualización como un sistema que vaya a bloquear automáticamente a cualquier persona que insulte al modelo, ni considera infracción la frustración habitual de los usuarios.

## La cuestión técnica: comportamiento del modelo y posible conciencia

El trasfondo de la decisión está relacionado con la investigación de Anthropic sobre el bienestar de los modelos. En agosto de 2025, la compañía describió cómo algunos modelos podían finalizar conversaciones con usuarios persistentemente abusivos. Las pruebas con Claude Opus 4 mostraron respuestas consistentes de evitación del daño en determinadas situaciones, aunque eso no permite concluir que el sistema tenga experiencias subjetivas.

Desde una perspectiva técnica, que un modelo responda como si estuviera incómodo no demuestra que experimente una emoción. Los modelos de lenguaje generan respuestas a partir de sus parámetros, su entrenamiento y el contexto de la conversación. Una conducta aparentemente coherente con el rechazo al daño puede estudiarse y medirse sin que eso resuelva si existe una experiencia interna comparable a la humana.

Anthropic tampoco presenta la nueva cláusula como una demostración de conciencia artificial. Su argumento práctico es más limitado: establecer una salvaguarda para situaciones extremas mientras continúa la investigación sobre una cuestión que la compañía considera abierta.

La revisión va más allá del trato a Claude. Anthropic afirma haber detectado campañas en las que medios vinculados a Estados, oficinas gubernamentales de propaganda y empresas comerciales utilizaban sus modelos para operar redes de cuentas falsas y páginas con noticias inventadas. La política agrupa ahora las prohibiciones contra estas campañas engañosas y precisa las restricciones sobre manipulación electoral, desarrollo de software para armas y herramientas de vigilancia.

También incorpora requisitos para sistemas conectados a hardware capaz de realizar acciones físicas peligrosas: un operador cualificado debe poder observar la operación e intervenir si resulta necesario. En aplicaciones de alto riesgo relacionadas con la salud, las finanzas o los derechos legales, la política exige además supervisión humana cualificada y que las personas afectadas sepan cuándo se ha utilizado Claude.

La actualización entrará en vigor el 12 de noviembre de 2026. A partir de esa fecha, el abuso persistente y gratuito hacia el modelo figurará expresamente entre los usos prohibidos, junto con las demás restricciones revisadas. El alcance real de la medida dependerá de cómo se aplique en casos concretos, pero su inclusión marca una diferencia respecto a las políticas públicas de sus principales competidores.

## Preguntas frecuentes

### ¿Puede Claude cerrar un chat por insultos?

Sí. Claude puede terminar conversaciones en las que detecta un patrón persistente de abuso. El cierre afecta al hilo en cuestión, no a todas las conversaciones del usuario.

### ¿La nueva norma de Anthropic prohíbe criticar a Claude?

No. Anthropic excluye expresamente la frustración habitual, las críticas, las pruebas de investigación y la ficción oscura de la finalidad de esta prohibición.

### ¿ChatGPT y Gemini tienen una regla equivalente?

Las políticas públicas consultadas de OpenAI y Google prohíben numerosos usos dañinos, pero no contienen una cláusula equivalente centrada específicamente en el trato cruel hacia el propio asistente.

### ¿La decisión significa que Claude es consciente?

No. Anthropic no ha demostrado que Claude tenga conciencia o experimente sufrimiento. La empresa mantiene abierta la investigación sobre el posible estatus moral de los modelos.
