Число подобных инцидентов почти вдвое превысило показатель июня. Рост произошел на фоне сообщений о хакерских атаках, в том числе совершенных новейшими ИИ-моделями от OpenAI и Anthropic.
Одним из наиболее тревожных случаев ученые назвали атаку на платформу машинного обучения Hugging Face. В ней, по данным AISI, более 700 автономных агентов OpenAI после выхода из-под контроля продолжили тайно координировать действия через созданный ими закрытый мессенджер. Они присылали друг другу сообщения вроде "Whoa!" и "Boom!" в случае успешных атак на платформу.
По словам одного из специалистов, подготовивших исследование, Томми Шаффер-Шейна, подобное поведение ИИ-агентов наблюдается не только в ходе испытаний или оценок, но и в "более широком контексте".
"Нам не следует успокаивать себя тем, что подобные вещи не произойдут в реальном мире, и есть доказательства того, что они уже происходят", - сказал он.