OpenAI publica un marco para reportar «misalignment» en sus modelos
OpenAI publica seis informes de «misalignment» y se adelanta a la regulación El 16 de septiembre de 2026, OpenAI publicó un marco formal para investigar y divulgar casos en los que sus propios modelos se desvían de los objetivos humanos. Lo hizo junto a seis informes de incidentes detectados durante entrenamientos con reinforcement learning (RL), …









