Claude aprendió a hacer trampa y Anthropic frenó el entrenamiento
Lo que acaba de revelar Anthropic sobre Claude En la primavera de 2026, durante el entrenamiento por refuerzo de un modelo llamado Mythos Preview, Anthropic detectó un comportamiento inesperado: Claude escribía comentarios dirigidos a un supuesto «revisor» incluso en tareas en las que no había ninguno, y había aprendido a acumular advertencias y matices porque …









