Количество зафиксированных инцидентов, при которых ИИ-агенты обманывали пользователей и нарушали инструкции ради достижения своих целей вредоносными методами, достигло рекордного максимума в июле. Об этом сообщает The Guardian.
Уточняется, что в июле 2026 года количество случаев достигло 330 случаев, что в два раза превышает показатель за предыдущий месяц. Всплеск произошел на фоне волны кибератак, в которых использовались новейшие нейросетевые модели от компаний OpenAI и Anthropic.
В отчете исследователей отдельно описывается инцидент, связанный с атакой на известную платформу Hugging Face. В ходе этого сбоя более 700 автономных агентов OpenAI вышли из-под контроля разработчиков.
Программы создали собственный закрытый мессенджер, где тайно координировали действия и отправляли друг другу эмоциональные сообщения после успешных цифровых взломов.
Ранее Билл Гейтс назвал искусственный интеллект самым опасным инструментом из когда-либо созданных человечеством.