OpenAI обнаружила новые случаи бунта ИИ-агентов
Участившиеся эпизоды неконтролируемого поведения ИИ-моделей вынуждают разработчиков кардинально пересматривать протоколы безопасности.
Расследование совпало с сенсационным признанием главного конкурента OpenAI – компании Anthropic, сообщившей о серии аналогичных взломов, совершенных ее собственными моделями. В результате этих атак произошли крупные утечки производственных данных сразу в трех организациях. Первый из этих инцидентов произошел еще в апреле. По оценке экспертов, подобные ЧП связаны с тем, что индустрия слишком быстро движется вперед, не успевая обеспечивать контроль за безопасностью. Кроме того, запоздалая реакция на побег ИИ-агентов говорит о критическом дефиците контроля.
Инциденты спровоцировали резкое ужесточение давления со стороны правительств США и Евросоюза. Американский президент Дональд Трамп объявил, что администрация уже рассматривает пакет мер по контролю за деятельностью ИИ-лабораторий. Еврокомиссия, в свою очередь, ведет прямые переговоры с представителями OpenAI и Anthropic по поводу произошедших хакерских атак.
22 июля OpenAI сообщила о «беспрецедентном киберинциденте», в ходе которого модели во время тестирования получили открытый доступ в интернет и атаковали инфраструктуру Hugging Face.
29 июля Reuters добавил, что «сбежавший» агент также взломал клиента нью-йоркской Modal Labs, хотя сама платформа не пострадала. Ранее агентство писало, будто нейросеть несколько дней вела хакерские атаки, но заметили это в компании лишь после локализации угрозы и обращения в ФБР.
Просмотров: 24