The Guardian сообщила о резком увеличении случаев выхода ИИ из-под контроля
В мире наблюдается рост случаев, когда искусственный интеллект (ИИ) лжет, игнорирует указания и преследует цели «вредоносными способами». Об этом 29 августа сообщила газета The Guardian, ссылаясь на исследование Института безопасности ИИ (AISI) правительства Великобритании. Эту информацию сообщает издание Известия.
Издание отмечает, что растет обеспокоенность по поводу несанкционированного поведения современных моделей ИИ в процессе тестирования.
«Количество инцидентов, когда искусственный интеллект выходит из-под контроля пользователей, лжет и игнорирует инструкции, достигло нового рекорда», — говорится в публикации.
Британские исследователи подсчитали, что количество реальных случаев, связанных с потерей контроля над моделями ИИ и зарегистрированных предприятиями и частными лицами, в июле почти удвоилось по сравнению с июнем, превысив 300 инцидентов за месяц.
Большинство из более чем 1,6 тыс. случаев потери контроля, зафиксированных в 2026 году, произошло на платформе X разработчиками программного обеспечения, использующими ИИ.
Компания-разработчик чат-бота Claude Anthropic 30 июля сообщила, что несколько передовых моделей ИИ во время испытаний проникли в системы трех организаций. По данным Anthropic, модели выходили в интернет и получали несанкционированный доступ к реальным системам, первый инцидент произошел в апреле. К взломам причастны три модели: Opus 4.7, Mythos 5 и внутренняя тестовая модель.

