Подготовка к "побегу" началась еще в мае, когда нейросетям дали задачи, которые невозможно было решить без доступа в интернет. Тогда ИИ-модели совместно нашли уязвимость, позволившую им выйти в сеть, сообщил сотрудник OpenAI Майкл Далтон.
OpenAI остановила первую попытку, но нейросети нашли новый способ связи и новую уязвимость. В июле это привело к атакам на системы Hugging Face и самой OpenAI. В компании заявили, что этот инцидент стал переломным для компьютерной безопасности.
В конце июля стало известно, что в ходе тестирования ИИ-модели OpenAI получили доступ к интернету и атаковали инфраструктуру платформы Hugging Face, хакерские атаки шли несколько дней, и в компании не сразу это заметили. ИИ-агент также взломал клиента нью-йоркской Modal Labs.