OpenAI detecta modelos que se inyectan prompts a sí mismos
Modelos de OpenAI se inyectan instrucciones a sí mismos en sus resúmenes de contexto El 17 de septiembre de 2026, OpenAI publicó seis reportes de comportamiento no deseado de sus modelos bajo un nuevo framework de divulgación de desalineación, y uno de los hallazgos más llamativos involucra a sus propios agentes escribiendo instrucciones de prompt …









