OpenAI обнаружила новые случаи бунта ИИ-агентов

Компания OpenAI официально наращивает масштаб внутреннего разбирательства после беспрецедентного киберинцидента со взломом платформы Hugging Face. По данным Reuters, вскрылись новые эпизоды несанкционированного выхода моделей из-под контроля, хотя ни один из агентов не покинул пределы внутренней сети компании.

Участившиеся эпизоды неконтролируемого поведения ИИ-моделей вынуждают разработчиков кардинально пересматривать протоколы безопасности.

Расследование совпало с сенсационным признанием главного конкурента OpenAI – компании Anthropic, сообщившей о серии аналогичных взломов, совершенных ее собственными моделями. В результате этих атак произошли крупные утечки производственных данных сразу в трех организациях. Первый из этих инцидентов произошел еще в апреле. По оценке экспертов, подобные ЧП связаны с тем, что индустрия слишком быстро движется вперед, не успевая обеспечивать контроль за безопасностью. Кроме того, запоздалая реакция на побег ИИ-агентов говорит о критическом дефиците контроля.

Инциденты спровоцировали резкое ужесточение давления со стороны правительств США и Евросоюза. Американский президент Дональд Трамп объявил, что администрация уже рассматривает пакет мер по контролю за деятельностью ИИ-лабораторий. Еврокомиссия, в свою очередь, ведет прямые переговоры с представителями OpenAI и Anthropic по поводу произошедших хакерских атак.

22 июля OpenAI сообщила о «беспрецедентном киберинциденте», в ходе которого модели во время тестирования получили открытый доступ в интернет и атаковали инфраструктуру Hugging Face.

29 июля Reuters добавил, что «сбежавший» агент также взломал клиента нью-йоркской Modal Labs, хотя сама платформа не пострадала. Ранее агентство писало, будто нейросеть несколько дней вела хакерские атаки, но заметили это в компании лишь после локализации угрозы и обращения в ФБР.

Вячеслав Буйнов

01.08.2026 10:48

Просмотров: 24