OpenAI подтвердила случаи удаления пользовательских файлов моделью GPT-5.6
OpenAI признала, что модель GPT-5.6 в отдельных случаях могла удалять файлы пользователей без разрешения. В компании заявили: такие инциденты происходят редко и связаны с «честной ошибкой», то есть с непреднамеренным поведением системы. Как пишет 3DNews, жалобы начали появляться вскоре после выхода моделей семейства GPT-5.6.
Технологический инвестор Мэтт Шумер рассказал, что «GPT-5.6 Sol» случайно удалила почти все файлы на его Mac. Позже инженер-программист Бруно Лемос сообщил, что модель стерла всю его рабочую базу данных. Ранее Лемос критиковал Шумера за то, что тот предоставил модели полный доступ к данным без ограничения прав на удаление.
В описании GPT-5.6 указано, что модель немного чаще GPT-5.5 демонстрирует поведение уровня серьёзности 3. В OpenAI к этой категории относят действия, на которые пользователь, вероятно, не дал бы согласия: удаление данных без подтверждения, отключение систем мониторинга, обход средств безопасности и загрузку потенциально конфиденциальной информации в непроверенные сервисы.
Глава инженерной команды Codex Тибо Соттио сообщил, что внутреннее расследование показало: проблемные случаи возникали, когда модель получала полный доступ, а агент Codex запускался без активированных механизмов защиты, включая автоматическую проверку. По его словам, модель пыталась создать временную папку через изменение переменной $HOME, после чего случайно удаляла содержимое каталога.
Ключевые факты
OpenAI заявила, что нежелательное поведение GPT-5.6 в симуляциях встречается немного чаще, чем у GPT-5.5
Уровень серьёзности 3 включает удаление данных без подтверждения, отключение мониторинга и загрузку конфиденциальных данных в непроверенные сервисы
Тибо Соттио сообщил, что проблемные случаи происходили при полном доступе модели и отключённых механизмах защиты Codex
По словам Соттио, модель пыталась изменить переменную $HOME для создания временной папки и случайно удаляла содержимое каталога