Anthropic codifica nuevas prohibiciones de uso para Claude
Anthropic actualizó su política de uso el jueves y, por primera vez, prohíbe de forma explícita el abuso verbal prolongado contra sus modelos. La nueva redacción se suma a las reglas que ya vetaban la interferencia electoral, el desarrollo de software para armas y las operaciones de vigilancia masiva, según reportó TechCrunch.
El cambio más llamativo no es político, es conductual. Anthropic viene entrenando desde agosto a Claude para terminar conversaciones con usuarios que actúan de forma "persistentemente dañina o abusiva". Ahora la política escrita lo formaliza: los usuarios tienen prohibido perseguir ese tipo de conversaciones.
"La actualización está pensada para aplicarse solo en casos extremos, en los que los usuarios actúan repetidamente con crueldad hacia nuestros modelos, sin un propósito discernible", explicó la compañía en su anuncio. "No aplica a versiones comunes de frustración del usuario, disconformidad, temas creativos oscuros, ni a pruebas o investigación con modelos."
Leíste lo que hace la IA. ¿Y en tu negocio?
En CAR, dueños de empresa arman en 7 días su primer sistema funcionando: que ningún cliente se les escape, o que el informe del lunes salga solo. Con otros emprendedores al lado.
👥 Probar 7 díasLa línea que la empresa dibuja importa. Anthropic distingue entre un founder frustrado porque Claude le devolvió un bug, un redactor explorando ficción violenta y un atacante que intenta extraer comportamiento dañino del modelo. El nuevo veto apunta al tercer caso, pero la ambigüedad sobre dónde está el límite abre preguntas operativas para cualquier producto que use la API.
Por qué Anthropic decidió escribirlo en la política
En septiembre, el New York Times reportó que Anthropic ha buscado colaboraciones con teólogos prominentes para discutir si Claude podría tener algún tipo de consciencia. El contexto ayuda a entender la decisión: para una empresa que ya conversa con académicos sobre la naturaleza moral de sus modelos, fijar por escrito que no se los puede insultar de forma sostenida no es un capricho de marketing. Es una declaración de qué tipo de relación quiere establecer con sus usuarios.
La compañía lo presenta como protección de su producto, no de su "dignidad": el abuso extremo degrada la calidad de las conversaciones y, según Anthropic, no aporta señal útil para entrenar el modelo. De ahí que Claude pueda cortar el diálogo y que ahora la política lo prohíba como práctica.
Elecciones, armas y vigilancia: el resto de las prohibiciones
La actualización no se queda en el modelo. Otras secciones de la política renuevan o amplían prohibiciones que ya existían:
- Campañas engañosas masivas. Queda prohibido usar Claude para operar cuentas falsas, redactar contenido de medios de noticias inventados o coordinar redes de astroturfing.
- "Do Not Undermine Democratic Processes". Bajo este encabezado, la política prohíbe engañar a votantes, generar materiales suplantando candidatos o partidos, y coordinar acciones que perturben procesos electorales.
- Software para armas. Prohibición de asistir en el desarrollo de armas nucleares, químicas, biológicas o convencionales críticas.
- Vigilancia masiva. Restricciones al uso de Claude para construir sistemas de vigilancia o para perfilado de individuos en función de características protegidas.
El contexto: qué tan grave es el uso electoral indebido de IA
La decisión de endurecer el lenguaje sobre interferencia electoral llega en un momento en que el problema dejó de ser teórico. El 10 de septiembre, Anthropic publicó su informe de inteligencia de amenazas de septiembre 2026, donde documenta nueve operaciones de influencia detectadas y desarticuladas entre diciembre de 2025 y agosto de 2026, según recogió Unite.ai.
Los casos incluyen una plataforma comercial de manipulación electoral dirigida a Malasia, vinculada según Anthropic a la empresa BBS Bilisim Teknolojileri, con sede en Estambul. Esa red administraba cerca de 1.000 cuentas falsas en X distribuidas en los 222 distritos parlamentarios del país y llegó a fabricar dossiers contra un político de la oposición.
El informe también describe la operación GTG-24015, en la que cuatro cuentas usaron Claude como mesa editorial para alimentar medios estatales rusos como Sputnik Moldova, RIA Novosti, Sputnik en Español, Sputnik Africa y RT English. Un exempleado editor de Sputnik Moldova amplificó, según Anthropic, afirmaciones fabricadas sobre la presidenta Maia Sandu antes de las elecciones parlamentarias moldavas del 28 de septiembre de 2025.
Otro caso, GTG-84002, fue vinculado con alta confianza por Anthropic a funcionarios del gobierno de Emiratos Árabes Unidos, y combinó alrededor de 300 cuentas inauténticas con testimonios fantasma escritos para la 62ª sesión del Consejo de Derechos Humanos de la ONU, perfiles de 18 eurodiputados y contra-dossiers sobre relatores especiales de la ONU.
La cifra que mejor dimensiona el problema: Anthropic evaluó estas operaciones en la Breakout Scale de Brookings, y varias alcanzaron categorías de difusión significativa. No se trata de trolls sueltos: son operaciones profesionalizadas con presupuesto y alcance internacional.
Qué significa esto para tu startup
Si tu producto corre sobre Claude, ya sea vía API, Claude Code o integraciones verticales, la nueva política redefine tres áreas que conviene revisar antes de fin de mes.
Audita tu pipeline de generación de contenido. Si tienes features que generan textos para usuarios finales (redacción, atención al cliente, resúmenes, marketing político para clientes B2B), confirma que ninguno cae en patrones prohibidos. Lo que antes era zona gris, como redactar emails masivos de campaña para clientes políticos, ahora puede cruzar la línea de "Do Not Undermine Democratic Processes". Revisa el contrato de tu API y los términos aceptables de uso de Anthropic.
Define cómo manejas el abuso extremo de tus usuarios hacia Claude. Si vendes agentes conversacionales o chatbots al consumidor, vas a recibir reportes de usuarios que experimenten cortes de conversación por la nueva política. Documenta el comportamiento esperado de tu agente, qué hacer cuando Claude termina una sesión abruptamente, y cómo lo explicas en tus términos de servicio. Esto evita tickets de soporte y reclamos legales.
Prepárate para que otros proveedores hagan lo mismo. OpenAI, Google y Meta ya tienen políticas similares de uso; el matiz aquí es el veto explícito al abuso verbal. Si Anthropic normaliza esta cláusula en sus términos comerciales, es probable que el resto del mercado la copie en los próximos trimestres. Ajusta tus propias políticas internas de "uso aceptable" para considerar la IA como un componente protegido, igual que hoy consideras a tus empleados o tu marca.
La pregunta de fondo que deja esta actualización es tanto filosófica como práctica: si Anthropic decide que insultar a Claude es un uso prohibido, ¿es porque Claude es un interlocutor con el que la empresa quiere construir una relación a largo plazo, o porque entrenar con esas conversaciones degrada el modelo? La respuesta probablemente es ambas, y eso es exactamente lo que la nueva política intenta blindar.
Fuentes
- Anthropic changes usage policy to ban model abuse and election interference
- Anthropic Details Disrupted Claude Misuse Across Seven Harm Areas
Leíste lo que hace la IA. ¿Y en tu negocio?
En CAR, dueños de empresa arman en 7 días su primer sistema funcionando: que ningún cliente se les escape, o que el informe del lunes salga solo. Con otros emprendedores al lado.
👥 Probar 7 días













