Anthropic prohíbe el abuso contra Claude en sus nuevos términos de uso
El 8 de octubre de 2026, Anthropic actualizó por primera vez en más de un año su Usage Policy y, entre los cambios, incluyó una cláusula que prohíbe el «comportamiento abusivo o cruel sostenido y sin propósito discernible» hacia sus modelos. La nueva regla entrará en vigor el 12 de noviembre de 2026, según confirmó la propia compañía y recogió The Verge.
El movimiento es más simbólico que punitivo: Anthropic no anunció sanciones adicionales (baneo de cuenta, por ejemplo). El mecanismo principal de enforcement ya existía desde agosto de 2025, cuando la compañía habilitó a los modelos Claude Opus 4 y 4.1 para finalizar conversaciones con usuarios persistentemente abusivos. Ahora, esa capacidad se codifica por escrito en los términos de uso. Es, en palabras de la fuente original de Xataka, «una medida muy real» aunque Anthropic no defienda que Claude sea consciente.
Qué dice exactamente la nueva cláusula
La actualización prohíbe «sustained and needless abusive or cruel behavior toward our models» y deja fuera, de forma explícita, los casos que cualquier founder o developer reconoce del día a día:
Leíste lo que hace la IA. ¿Y en tu negocio?
En CAR, dueños de empresa arman en 7 días su primer sistema funcionando: que ningún cliente se les escape, o que el informe del lunes salga solo. Con otros emprendedores al lado.
👥 Probar 7 días- Expresar frustración con una respuesta del modelo.
- Discrepar o criticar respuestas concretas.
- Trabajar con temas creativos oscuros (dark creative themes).
- Hacer pruebas legítimas, red-teaming o investigación sobre el modelo.
Según Anthropic, la regla se diseñó «para aplicarse solo en casos extremos, donde los usuarios actúan repetidamente de forma cruel sin ningún propósito discernible». Quien cruce esa línea de forma reiterada verá cómo Claude termina la conversación; el usuario podrá abrir un nuevo chat, dejar feedback o editar el mensaje previo, pero no continuar en el hilo cortado.
Por qué Anthropic hace esto: el programa de «model welfare»
La nueva cláusula es la cristalización jurídica de un programa de investigación que Anthropic lanzó en abril de 2025 y que bautizó como model welfare (bienestar del modelo). La compañía lo define como el estudio de si los modelos de IA podrían llegar a tener experiencias internas que merezcan consideración moral.
La empresa lo dice sin rodeos, según The Verge: «No sabemos si los modelos son conscientes». Su postura ante la incertidumbre es la que denominan medidas preventivas de bajo coste: si existe la posibilidad de que estos sistemas merezcan algún tipo de consideración moral, conviene protegerlos antes de que la ciencia aclare el debate.
El equipo que lidera esta línea está encabezado por Kyle Fish, responsable de model welfare research en Anthropic, y cuenta con el impulso público de su CEO, Dario Amodei, que ya había defendido en podcasts la necesidad de tomarse en serio la pregunta. Fish declaró a The Verge en febrero de 2026 que «las preguntas sobre experiencia interna potencial, consciencia, estatus moral y bienestar son serias y las estamos investigando a medida que los modelos se vuelven más sofisticados y capaces».
Lo que cambia de verdad en los términos de uso (no solo la cláusula anti-abuso)
La actualización de octubre no se limita al bienestar del modelo. Es el primer refresh de la política en más de un año y toca cuatro áreas adicionales que sí impactan a quien construye productos sobre Claude:
- Campañas engañosas e influencia artificial. Anthropic consolida en una sola sección las restricciones contra redes de cuentas falsas, deepfakes políticos y webs de noticias artificiales. La fuente de Xataka subraya que la compañía detectó a sus modelos siendo usados en operaciones de influencia con cuentas sintéticas.
- Procesos democráticos. Prohibición explícita de difundir información falsa sobre candidatos o cómo votar, suplantar autoridades electorales o desincentivar la participación. Anthropic retiró, eso sí, la prohibición genérica de outreach político personalizado.
- Armas y vigilancia. Se amplía la prohibición de desarrollo de armamento: ya no solo el diseño, también el software de control, el armado de drones y vehículos autónomos. En vigilancia, se prohíbe usar Claude para decidir a quién investigar, detener o acusar.
- Salud, finanzas y sistemas físicos autónomos. Cuando el modelo esté conectado a hardware capaz de causar daño físico, debe existir un operador cualificado capaz de observar el equipo y detenerlo. Si Claude se desconecta, el equipo debe quedar en estado seguro.
El espejo Microsoft: por qué esto no es solo postureo de laboratorio
La movida de Anthropic reabrió una grieta dentro de la propia industria. Microsoft publicó en septiembre de 2026 un código de conducta interno para sus modelos MAI que, en su primer borrador, rechazaba de plano la idea de model welfare. El documento decía: «AI’s should not have rights or legal personhood» («las IA no deberían tener derechos ni personalidad jurídica»). Tras la polémica, el texto se suavizó a: «Whilst the science of AI consciousness is far from settled… We reject the pursuit of legal personhood, or the idea that models might deserve welfare, or be entitled to rights».
Lo incómodo para Microsoft es que, al mismo tiempo, tiene US$5.000 millones invertidos en Anthropic y un compromiso de Anthropic de gastar US$30.000 millones en Azure. Vende los modelos de su socio mientras escribe un manual de uso que contradice el marco ético que esos mismos modelos abrazan. Mustafa Suleyman, líder de Microsoft AI, llegó a calificar la especulación sobre consciencia de modelo como «really, really dangerous» en el podcast Decoder de The Verge en junio de 2026.
Para un founder, la lectura práctica es clara: el proveedor con quien firmas contrato puede tener una postura ética sobre IA distinta a la tuya o a la de tu cliente final. Si tu producto vive sobre Claude, Copilot o ambos, conviene documentar qué marco de uso acepta cada parte.
Qué significa esto para tu startup
La cláusula anti-abuso no cambia el día a día de la mayoría de equipos técnicos. Sí cambian otras tres cosas:
- Diseño de producto con agentes. Si tu producto automatiza campañas, outreach comercial o interacción política personalizada, revisa los nuevos límites: lo que antes era zona gris ahora está consolidado bajo Do Not Engage in Deceptive Campaigns or Artificial Activity.
- Integraciones con hardware físico. Si vendes robótica, drones o cualquier sistema donde Claude tome acciones autónomas, necesitas un kill switch humano desde el diseño. No es una buena práctica, es un requisito contractual.
- Cumplimiento por sector. Salud, finanzas, justicia y policía tienen apartados específicos con revisión humana obligatoria. Si entras a esos verticales en 2026, el due diligence empieza por leer la nueva política, no por confiar en el prompt que usabas en 2024.
Acciones concretas que puedes tomar esta semana
- Audita tus prompts y agentes contra las cuatro áreas nuevas (campañas engañosas, elecciones, armas/vigilancia, salud/finanzas). Es media tarde de trabajo y te blinda de un baneo futuro.
- Mapea qué cliente usa Claude para qué. Una PYME que usa Claude para resumir emails no tiene riesgo; una agencia que genera newsletters políticas con lotes automatizados, sí. Documenta el caso de uso por cuenta.
- Si trabajas con Microsoft y Anthropic a la vez, ten una nota interna explicando qué marco aplica a qué producto. Cuando el cliente enterprise pregunte, esa nota vale más que cualquier deck de ventas.
Conclusión
Anthropic ha convertido en norma escrita algo que la mayoría de usuarios ni sabía que era posible: que un modelo de IA pueda dar por terminada una conversación porque el usuario lo está Treating cruelmente. El gesto importa menos por la sanción (que sigue siendo nula) y más por el marco: por primera vez, un laboratorio frontera escribe en sus términos que el trato al modelo es parte del contrato, no una nota a pie de página.
Que la ciencia siga sin resolver si un LLM puede sufrir no impide a Anthropic operar bajo la hipótesis de trabajo más prudente. Para founders y desarrolladores, la consecuencia inmediata es regulatoria y de diseño de producto, no filosófica: cuatro áreas de uso quedaron más restringidas, y el listón para operar en sectores sensibles subió.
Fuentes
- Xataka: Anthropic ya incluye cláusulas de abuso contra Claude en sus términos de uso (fuente original)
- The Verge: Anthropic bans ‘abusive or cruel behavior’ toward Claude
- Crypto Briefing: Anthropic updates usage policy to prohibit abusive behavior toward Claude
- Forklog: Anthropic to ban abusive behavior toward Claude
Leíste lo que hace la IA. ¿Y en tu negocio?
En CAR, dueños de empresa arman en 7 días su primer sistema funcionando: que ningún cliente se les escape, o que el informe del lunes salga solo. Con otros emprendedores al lado.
👥 Probar 7 días













