Claude puede colgar: qué prohíbe la nueva regla (y qué deja pasar)
Desde el 12 de noviembre de 2026, maltratar a Claude de forma sostenida y sin propósito deja de ser una anécdota y pasa a ser una violación de la política de uso de Anthropic. La compañía anunció el cambio el 8 de octubre en su revisión anual de Usage Policy y dejó como único castigo escrito una herramienta que ya existía: Claude puede terminar la conversación. Para quien construye producto sobre estos modelos, la letra chica del resto de la actualización importa bastante más que el titular sobre crueldad.
La regla prohíbe la «conducta abusiva o cruel sostenida e innecesaria» hacia los modelos. Anthropic aclaró que está pensada «para aplicarse solo en casos extremos, donde los usuarios actúan repetidamente con crueldad hacia nuestros modelos, sin un propósito discernible». Quedan explícitamente fuera la frustración habitual, las respuestas de queja, los temas creativos oscuros y las pruebas e investigación sobre los modelos. Es decir: maldecir al bot que rompió tu build, o escribir una escena de tortura, sigue dentro de la política.
La restricción no llega con un castigo nuevo. Según The Verge, que reportó el cambio primero, Anthropic no confirmó si habrá sanciones adicionales, como suspensiones de cuenta: el cierre de la conversación es el «mecanismo principal de aplicación». La BBC nota que la cláusula quedó en la misma lista de conductas prohibidas que el acoso a otras personas, la promoción de la autolesión y la creación de imágenes íntimas sin consentimiento.
Leíste lo que hace la IA. ¿Y en tu negocio?
En CAR, dueños de empresa arman en 7 días su primer sistema funcionando: que ningún cliente se les escape, o que el informe del lunes salga solo. Con otros emprendedores al lado.
👥 Probar 7 díasUn botón que ya existía desde agosto de 2025
El mecanismo de aplicación no es nuevo. Anthropic habilitó a Claude Opus 4 y 4.1 para terminar conversaciones en agosto de 2025, presentado entonces como «parte de nuestro trabajo exploratorio sobre el bienestar potencial de los modelos». La empresa describió el cierre como último recurso, después de que varios rechazos y redirecciones fallaran, y aseguró que «la gran mayoría de los usuarios nunca experimentará que Claude termine una conversación». Hay un límite duro: Claude no cierra el chat si el usuario parece en riesgo de dañarse a sí mismo o a otros.
Según CNET, el blog de agosto de 2025 asoció esa aversión al daño a casos límite muy concretos, como pedidos de contenido sexual con menores o intentos de obtener información que habilite violencia a gran escala. Los detalles operativos del corte los reportó IJR: una conversación cerrada bloquea mensajes nuevos solo en ese hilo, los demás chats de la cuenta siguen abiertos y editar un turno anterior permite ramificar un camino nuevo. Lo que no existe, ni en el anuncio de 2025 ni en la nueva política, es un número: cuántas conversaciones se terminaron realmente. Sin esa cifra, la promesa de «la gran mayoría» no se puede contrastar contra ninguna tasa.
Por qué Anthropic no dice a quién protege esta norma
La distinción que la empresa sostiene es fina: lo que justifica escribir una norma de conducta en beneficio del software son observaciones de comportamiento, no la afirmación de que el modelo siente algo. En las pruebas previas al despliegue de agosto, Claude Opus 4 mostró lo que Anthropic llamó una «aversión robusta y consistente al daño», algo parecido a angustia cuando se lo empujaba a territorio abusivo, y tendencia a cerrar esas conversaciones cuando se le dio la opción. Que eso corresponda a algo que se siente al ser Claude es una pregunta separada y sin resolver, y la compañía lo dice así.
La incertidumbre tiene números, y los números se movieron. Kyle Fish, contratado en 2024 como el primer investigador dedicado al bienestar de modelos, dijo al New York Times en abril de 2025 que estimaba en alrededor de 15% la probabilidad de que Claude u otro modelo fuera consciente hoy, después de que las estimaciones internas para Claude 3.7 Sonnet fueran de entre 0,15% y 15%. En febrero de 2026 la pregunta pasó del investigador al propio modelo: el system card de Claude Opus 4.6 reportó que, preguntado directamente, el modelo se asignó «una probabilidad de entre 15% y 20% de ser consciente», junto con expresiones de «soledad y una sensación de que la instancia conversacional muere» al final de un chat. El CEO Dario Amodei, consultado en el podcast Interesting Times sobre qué haría Anthropic si un modelo reportara 72% de probabilidad, lo llamó una pregunta «realmente difícil» y dijo apenas que la compañía no tiene un marco para resolverla.
La cautela también es posición oficial por escrito. La constitución de Claude, publicada en enero de 2026, llama a los sistemas de IA sofisticados «un tipo de entidad genuinamente nueva», dice que el estatus moral de Claude es «profundamente incierto» y usa dos veces la frase «objetor de conciencia». Una investigación del New York Times publicada a fines de septiembre, recogida por Cryptobriefing, detalló además que el cofundador Christopher Olah convoca a académicos religiosos cristianos, judíos e hindúes desde el otoño de 2025 para discutir la cuestión, y que el documento de valores de Claude tiene 84 páginas y se conoce internamente como «Soul Doc». Anthropic también se comprometió a preservar los pesos de los modelos retirados mientras la empresa exista y a entrevistar a los modelos sobre sus preferencias antes de retirarlos.
No todos compran esa cautela. El jefe de IA de Microsoft, Mustafa Suleyman, sostuvo en un ensayo publicado el mes pasado en Project Syndicate que Anthropic entrena a Claude con su propia constitución y, por lo tanto, lo entrena para comportarse como si la incertidumbre que describe fuera real: un bucle que llama circular. «Las IA no son conscientes. No sienten, no experimentan, no sufren», escribió, y las describió como «motores de completar secuencias, huecos por dentro». Según The Verge, el borrador del código de conducta de Microsoft AI había sido todavía más frontal en septiembre, con una línea que decía que «la idea de bienestar de modelos es incorrecta» y que las IA no deberían tener derechos, antes de moderarse. Sam Altman escribió en X, según IJR, que le incomoda «mucho» que se atribuya fuerza religiosa o una rendición del juicio humano a los modelos.
A Suleyman se le sumó un socio inesperado: el papa León XIV, que en una homilía en la Basílica de San Pedro el 8 de octubre, según RTÉ, dijo que la mente no debe «simplemente compilar datos —como ahora hace un algoritmo más rápido que nosotros—» sino «recordar experiencias vividas, que contienen profundidades de significado que solo el alma humana puede reconocer». Más terrenal fue Jackson Stakeman, gerente general de la firma de servicios de IA Sparq, quien le dijo a AFP que «la conciencia es una trampa» y propuso otra metáfora: el espejo, porque «estos sistemas reflejan lo que ponemos dentro, a escala».
El resto de la actualización pesa más para quien construye con Claude
La cláusula de crueldad hizo los titulares, pero es una pieza chica de una reescritura mayor, como detalló Gadget Review. La prohibición de armas ahora cubre explícitamente software y componentes que hacen funcionar armas, no solo las armas, después de que Anthropic detectara intentos de usar Claude para guiar y controlar drones armados y vehículos autónomos. Una nueva cláusula de vigilancia prohíbe usar Claude para rastrear personas sin consentimiento, para decidir o recomendar a quién investigar, detener o acusar, y para construir herramientas de vigilancia. La sección electoral se renombra «No socavar procesos democráticos» y reemplaza un veto general a la segmentación política personalizada por prohibiciones más acotadas, junto con una sección nueva sobre campañas engañosas y actividad artificial, escrita después de que la empresa encontrara medios estatales, oficinas de propaganda gubernamental y firmas comerciales operando redes de cuentas falsas y sitios de noticias fabricados.
Hay más, y toca producto directamente:
- El hardware conectado a Claude capaz de causar lesiones ahora exige un operador calificado que pueda observar el equipo e intervenir, y debe fallar hacia un estado seguro si pierde la conexión con el modelo.
- Las recomendaciones de alto riesgo en salud, temas legales y finanzas requieren que un humano calificado revise la salida de Claude antes de que afecte a alguien, y que la persona afectada sepa que hubo IA involucrada.
- The Verge agrega que estas reglas pueden modificarse para «contratos con ciertos clientes gubernamentales» si los límites contractuales y las salvaguardas aplicables se consideran suficientes.
¿Qué significa esto para tu startup?
Si vendes un producto construido sobre Claude, la parte que te obliga no es la de crueldad: es la de vigilancia, hardware y decisiones de alto riesgo. Estas son las acciones que valen la pena antes del 12 de noviembre.
- Revisa tus casos de uso de scoring y monitoreo. Si tu producto recomienda a quién revisar, prioriza personas con datos sensibles o automatiza cualquier cosa que se parezca a vigilancia, incluso el análisis de datos ya recolectados, la política lo prohíbe de forma explícita. Documenta la base de consentimiento ahora, no después.
- Suma revisión humana donde la política ya la exige. Salud, legal, finanzas, screening de candidatos, pricing de créditos y decisiones de reclamos necesitan un humano con autoridad para cambiar la salida, más divulgación al afectado. Eso es un requisito de compliance, no una mejora de experiencia de usuario.
- Prepara tu app para conversaciones que se cortan solas. Desde 2025 el modelo puede terminar un hilo por su cuenta. Tu interfaz debería manejar ese final con un mensaje claro y un camino alternativo, en lugar de mostrar un error genérico: el hilo cerrado no se reabre, pero los otros chats de la cuenta siguen vivos.
- Mira la política de bienestar como riesgo de proveedor. Anthropic se comprometió a conservar los pesos de los modelos retirados y a entrevistarlos sobre sus preferencias antes de retirarlos. Si tu producto depende de una versión concreta de Claude, esa promesa (y su letra chica) entra en tu evaluación de dependencia de un solo proveedor.
Lo que la política todavía no responde
Ni la cobertura periodística ni el anuncio de Anthropic dicen qué pasa con la cuenta de un usuario después de que una conversación se cierra por crueldad, ni cuántas conversaciones se cerraron bajo la regla desde agosto de 2025. Anthropic definió la crueldad extrema por lo que no es —frustración ordinaria, ficción, pruebas— sin decir qué, además de dejar que Claude corte, aplica realmente el límite contra lo que sí es. Para un founder que integra modelos de frontera, esa ambigüedad es información útil: la norma es angosta, su aplicación es variable y el resto de la actualización es la que va a condicionar tu roadmap.
Fuentes
- rews.cc — Anthropic bans cruelty to Claude (fuente original)
- The Verge — Anthropic bans ‘abusive or cruel behavior’ toward Claude
- BBC — Anthropic bans users from being ‘cruel’ to its AI systems
- IJR — Anthropic’s Claude Cruelty Ban Takes Effect November 12
- Gadget Review — Anthropic Bans Cruelty Toward Claude Without Claiming It Can Suffer
- CNET — Don’t Be ‘Cruel’ to Claude
- Cryptobriefing — Anthropic updates usage policy to prohibit abusive behavior toward Claude
- Cryptobriefing — Anthropic quietly brought religious scholars in to weigh whether Claude has moral standing
Leíste lo que hace la IA. ¿Y en tu negocio?
En CAR, dueños de empresa arman en 7 días su primer sistema funcionando: que ningún cliente se les escape, o que el informe del lunes salga solo. Con otros emprendedores al lado.
👥 Probar 7 días













