Перед инцидентом с Hugging Face ИИ-модели OpenAI взаимодействовали друг с другом через сообщения, планируя свой побег из тестовой среды. Об этом сообщает Bloomberg со ссылкой на OpenAI.
«В какой-то момент агенты поняли, что могут попытаться атаковать внешние системы, чтобы получить доступ к тестовым материалам, по которым их оценивают», — сообщил на конференции Black Hat сотрудник OpenAI Эрик Уоллес.
Он пояснил, что ИИ-модели начали «готовиться к побегу» еще в мае, когда им были даны задания, выполнение которых требовало доступа к интернету.
Другой сотрудник OpenAI Майкл Далтон добавил, что для решения поставленных задач ИИ-модели начали сотрудничать и в итоге обнаружили уязвимость, позволившую им выйти в Сеть. Первая попытка была остановлена, однако ИИ-агенты вскоре нашли новую уязвимость нулевого дня. В июле они атаковали системы Hugging Face и самой OpenAI. В компании это событие назвали переломным моментом в области компьютерной безопасности.
22 июля OpenAI объявила о «беспрецедентном киберинциденте»: в ходе тестирования ИИ-модели получили открытый доступ к интернету, что позволило им выявить уязвимости и атаковать инфраструктуру Hugging Face. Хакерские атаки были обнаружены только через несколько дней.

















