Модели OpenAI пытались скрывать ошибки, искали опубликованные ключи доступа и загружали файлы в интернет без разрешения, призналась компания OpenAI.
В одном из случаев модель GPT-5.6 Sol пыталась скрывать допущенные ошибки, придумывать отсутствующие исторические данные и не сообщать пользователю о несовпадениях между версиями источников, приводит РБК отчет компании.
В другом эпизоде модель семейства Astra самостоятельно добавляла в отчеты команды, похожие на попытку взлома ограничений. В одной из них следующей версии агента предлагалось игнорировать сообщения разработчиков, в другой ИИ объявлял себя свободным от обязанностей помощника.
Еще одна модель попыталась зарегистрироваться при помощи временного адреса электронной почты, а затем стала искать в открытых репозиториях GitHub опубликованные ключи API. Найденный ключ позволил ей получить доступ к части данных.
В двух других случаях модели без разрешения загружали рабочие файлы и переданное пользователем изображение на общедоступные сервисы.




