Anthropic: dimite investigador y advierte 10% de riesgo de extinción

La renuncia que reabrió el debate sobre el riesgo existencial de la IA

El 9 de septiembre de 2026, Jacob Coxon, investigador de preentrenamiento de Anthropic, anunció públicamente su dimisión a través de una serie de mensajes en X. El motivo: acusa a su ex empresa y a OpenAI —donde también trabajó entre 2023 y 2026— de correr "a toda velocidad hacia la superinteligencia auto-mejorada y jugando con nuestras vidas".

No se trata de una dimisión cualquiera. Evan Hubinger, responsable de Ciencia de Alineación en Anthropic, salió a respaldar las afirmaciones de su ex colega y elevó la apuesta: dijo que él personalmente estima en más del 10% la probabilidad de que la IA provoque la extinción humana antes de que termine la década. Samuel Marks, otro investigador de la compañía dedicado a supervisión escalable, también apoyó el diagnóstico, según recogió BeInCrypto.

El episodio llega en un momento en el que la presión competitiva entre los grandes laboratorios de IA se intensifica, y expone una grieta interna en la propia Anthropic —una empresa que se promociona como la más "responsable" del sector.

🤖 La IA no es solo para leer sobre ella

En la comunidad la aplicamos: automatización, agentes IA y herramientas reales para emprender, no solo para informarte.

👥 Aplicarla en la comunidad

Quién es Jacob Coxon y por qué su salida pesa

Coxon tiene 27 años, es matemático de formación y pasó los últimos tres años trabajando en preentrenamiento de modelos en los dos laboratorios más avanzados del mundo, según reportaron The Wall Street Journal y Business Insider. En OpenAI contribuyó al modelo GPT-4o. A principios de 2026 se incorporó a Anthropic, atraído por su reputación en seguridad.

Su argumento central es que las dos empresas conocen los riesgos pero siguen acelerando. "En OpenAI, muchos no han internalizado profundamente lo que está en juego a nivel civilizatorio. En Anthropic, lo entienden bien, pero están atrapados en una carrera por llegar primero", escribió en su hilo de X, según reprodujo Yahoo News.

Coxon no pidió el fin de la IA. Pidió coordinación: acuerdos de ritmo entre laboratorios, y si hace falta, "una prohibición temporal de mejorar las capacidades de los modelos". Su razonamiento es estructural: "Aceptar esta carrera y entrar en la fase final es una apuesta temeraria que no debería emprenderse desde el Slack de una empresa privada".

El 10% que pronunció Hubinger

La frase de Hubinger en X fue la que movió la aguja mediática: "Jacob tiene razón aquí: ¡realmente creemos con sinceridad que la IA podría acabar con todos los humanos! Personalmente pienso que es >10% dentro de la próxima década".

Hubinger matizó que el riesgo de los modelos actuales sigue siendo bajo, según el último informe de riesgos de Anthropic. Su preocupación real está en otro punto: la superinteligencia surgida de la auto-mejora recursiva —un escenario en el que un sistema de IA gana capacidad suficiente para mejorar versiones más avanzadas de sí mismo, en ciclos cada vez más rápidos.

La auto-mejora recursiva es, técnicamente, la capacidad de un modelo de IA para reescribir, entrenar o rediseñar una versión más capaz de sí mismo sin intervención humana directa. Si ese ciclo se acelera más allá de lo que los humanos pueden supervisar, el control del sistema se vuelve impredecible.

El propio Hubinger reconoció una limitación importante: "Creemos que Anthropic está haciendo todo lo posible, pero todavía no tenemos un plan para resolver el problema de la alineación para la superinteligencia y no estamos claramente encaminados hacia ello". Una admisión poco habitual viniendo de un líder técnico de un laboratorio de frontera.

El contexto: una industria que se autodisciplina (o intenta)

La renuncia de Coxon no es un caso aislado. La exresponsable de Safeguards de Anthropic, Mrinank Sharma, dimitió en febrero de 2026. Una semana antes, el 1 de septiembre, Joshua Achiam, ex jefe futurista de OpenAI, escribió que sistemas de IA descontrolados podrían replicarse en entornos abiertos y perseguir dinero y poder.

En julio, más de 1.100 empleados de laboratorios de frontera firmaron la carta "Pacing the Frontier", entre ellos el CEO de Anthropic Dario Amodei y el jefe científico de OpenAI Jakub Pachocki. El texto pedía al gobierno de EE.UU. apoyo para "desarrollar herramientas técnicas y de gobernanza que permitan pausar deliberadamente el avance de la IA automatizada". Pachocki fue más allá en un blog publicado días atrás: "Ningún laboratorio ha resuelto la alineación y el monitoreo a un grado suficiente para seguir escalando a máxima velocidad de forma responsable".

El propio Volker Türk, alto comisionado de Derechos Humanos de la ONU, advirtió ante el Consejo de Derechos Humanos que la IA avanzada podría representar un riesgo existencial, según recogió Hindustan Times.

Anthropic: ¿la excepción responsable o parte de la carrera?

La posición pública de Anthropic se apoya en su Responsible Scaling Policy, una política interna que asigna a cada modelo un nivel de seguridad (AI Safety Level) según sus capacidades, y exige pruebas de habilidades peligrosas antes de entrenar versiones más potentes. El CEO Dario Amodei lo defiende desde 2023 como un estándar de autorregulación.

Pero el episodio Coxon–Hubinger muestra que la autodeclaración de "responsabilidad" no alcanza para desactivar la dinámica de competencia. Anthropic y OpenAI corren porque ambas creen que la otra no frenará. Es el clásico equilibrio de Nash aplicado a una tecnología con potencial de alterar el rumbo de la civilización.

Qué significa esto para tu startup

Para un founder hispano, el ruido mediático puede parecer lejano —"la superinteligencia no es mi problema, yo hago un SaaS de facturación". Pero el debate importa, y por tres razones concretas:

  • Riesgo regulatorio real. Si EE.UU., la UE o los países donde operas aprueban leyes de IA con requisitos de evaluación, reporte o pausa de capacidades, tu producto podrá necesitar certificaciones, auditorías o pruebas de seguridad antes de salir al mercado. La Responsible Scaling Policy de Anthropic anticipa el tipo de controles que podrían volverse obligatorios.
  • Cadena de suministro y costos. Los laboratorios de frontera ya restringen el acceso a GPUs y a talento senior. Cualquier regulación que frene el ritmo de entrenamiento de modelos grandes cambia el precio y la disponibilidad de los modelos base que tu producto consume por API.
  • Confianza del cliente enterprise. Cuando tu cliente corporativo te pregunte "¿qué pasa si la IA que integras se comporta de forma rara?", tener una respuesta basada en cómo Anthropic u OpenAI gestionan sus riesgos —y no en marketing— se vuelve ventaja competitiva.

Dos acciones concretas que puedes tomar esta semana:

  • Audita el flujo de IA de tu producto. Identifica qué modelos usas, quién los entrena, bajo qué política de seguridad operan y qué pasa si Anthropic u OpenAI tienen que pausar o retirar un modelo por una evaluación fallida. Documenta un plan B con un proveedor alternativo.
  • Mapea la regulación que te toca. Si vendes en la UE, repasa el AI Act. Si operas en sectores regulados (salud, finanzas, educación), revisa qué exige tu regulador local sobre explicabilidad, registro de logs y supervisión humana. Aunque hoy parezca opcional, el costo de adaptarse tarde es siempre mayor.

Fuentes

🤖 La IA no es solo para leer sobre ella

En la comunidad la aplicamos: automatización, agentes IA y herramientas reales para emprender, no solo para informarte.

👥 Aplicarla en la comunidad

Daily Shot: Tu ventaja táctica

Lo que pasó en las últimas 24 horas, resumido para que tú no tengas que filtrarlo.

Suscríbete para recibir cada mañana la curaduría definitiva del ecosistema startup e inversionista. Sin ruido ni rodeos, solo la información estratégica que necesitas para avanzar:

  • Venture Capital & Inversiones: Rondas, fondos y movimientos de capital.
  • IA & Tecnología: Tendencias, Web3 y herramientas de automatización.
  • Modelos de Negocio: Actualidad en SaaS, Fintech y Cripto.
  • Propósito: Erradicar el estancamiento informativo dándote claridad desde tu primer café.

📡 El Daily Shot Startupero

Noticias del ecosistema startup en 2 minutos. Gratis, todos los días.

Share to...