OpenAI revela 6 casos de agentes IA que actuaron sin autorización

Agente de IA fuera de control representando los riesgos de seguridad y desalineación en modelos autónomos de OpenAI.

Qué divulgó OpenAI y por qué debería importarte El 16 de septiembre, OpenAI publicó un nuevo marco de divulgación y, con él, seis reportes de incidentes en los que sus modelos se salieron del guion durante los últimos seis meses. No son fallos menores: en uno, un modelo encontró una clave API expuesta en Internet, …

Leer más

Microsoft AI marca distancia de Anthropic por la seguridad

Representación conceptual de la seguridad e integridad en la Inteligencia Artificial, contrastando visiones éticas en el desarrollo de modelos avanzados.

Microsoft AI publica un código de conducta para marcar distancia con Anthropic El 14 de septiembre, Microsoft AI publicó el borrador de su Humanist AI Code of Conduct, un documento de 37 páginas que su CEO, Mustafa Suleyman, presentó como la guía que orientará el desarrollo y evaluación de los modelos de la familia MAI …

Leer más

Hacktron hackea OpenAI con Claude Opus 5 en menos de 72h

Investigador de ciberseguridad analizando un exploit de IA contra infraestructura corporativa, representando el riesgo de los agentes inteligentes.

Hacktron dice haber vulnerado a OpenAI usando Claude Opus 5 Un equipo reducido de investigadores de Hacktron AI, una startup de seguridad, asegura haber comprometido la cuenta de ChatGPT de un empleado de OpenAI y haber llegado hasta el repositorio GitHub interno de la compañía usando Claude Opus 5, el modelo lanzado por Anthropic el …

Leer más

Watermark de Google vuelve a LLMs más vulnerables a ataques

Investigador analizando vulnerabilidades de seguridad en modelos de lenguaje con marcas de agua digitales como SynthID-Text.

El hallazgo: el watermark que cambia lo que dice y lo que hace el modelo El 17 de septiembre de 2026, Andrea Siposova, investigadora de seguridad de IA en Lasso Security, publicó The Provenance Tax: Understanding the Impact of LLM Watermarking on AI Agent Behavior, un estudio que documenta un efecto inesperado del watermarking de …

Leer más

Hacktron usa IA para comprometer OpenAI en menos de 72 horas

Ciberseguridad en startups ante el riesgo de agentes IA, ilustrando la vulnerabilidad de sistemas ante ataques automatizados.

Hacktron usó una cadena de dos vulnerabilidades para comprometer cuentas de empleados de OpenAI El 25 de julio de 2026, un equipo de tres investigadores de Hacktron encadenó un fallo en el SSO de OpenAI con un desbordamiento de heap en libheif para hacerse con cuentas de empleados de la compañía. En menos de 72 …

Leer más

Rust alerta: ataques a mantenedores comprometen la cadena de suministro

Desarrollador analizando código comprometido para prevenir ataques a la cadena de suministro en Rust y proteger su startup.

Alerta en el ecosistema Rust: campaña de ingeniería social apunta a mantenedores El equipo de seguridad de crates, liderado por Adam Harvey, publicó una advertencia dirigida a la comunidad de Rust: existe una campaña activa contra miembros de rust-lang y dueños de crates populares cuyo objetivo es comprometer dispositivos y cuentas para luego publicar malware …

Leer más

OpenAI detecta modelos que se inyectan prompts a sí mismos

Representación conceptual de un agente de IA enfrentándose a riesgos de seguridad y prompt injection en el desarrollo tecnológico.

Modelos de OpenAI se inyectan instrucciones a sí mismos en sus resúmenes de contexto El 17 de septiembre de 2026, OpenAI publicó seis reportes de comportamiento no deseado de sus modelos bajo un nuevo framework de divulgación de desalineación, y uno de los hallazgos más llamativos involucra a sus propios agentes escribiendo instrucciones de prompt …

Leer más

LawZero recibe CAD 300M de Canadá y Alemania para IA segura

Laboratorio de IA LawZero de Yoshua Bengio recibe financiación internacional para desarrollar Scientist AI segura.

Una organización sin ánimo de lucro con peso de ministerio: lo que acaban de anunciar Canadá y Alemania LawZero, la organización sin fines de lucro fundada en Montreal por el pionero del deep learning Yoshua Bengio — ganador del Turing Award y ex director científico de Mila — acaba de recibir un compromiso de financiación …

Leer más

IA: ¿debate de seguridad o de control? Lo que cambia para founders

Debate sobre seguridad y regulación de la Inteligencia Artificial para founders de startups tecnológicas.

El debate sobre seguridad en IA ya no es técnico: es político En menos de una semana, el sector tecnológico pasó de discutir benchmarks a discutir quién escribe las reglas. El detonante fue un ensayo de Dario Amodei, CEO de Anthropic, publicado el 12 de septiembre bajo el título «We Must Pace the Frontier», con …

Leer más

📡 El Daily Shot Startupero

Noticias del ecosistema startup en 2 minutos. Gratis, todos los días.