Стало известны подробности киберавзлома, который осуществила OpenAI в отношении другой компании. Как оказалось, признаки аномального поведения ИИ-агента были зафиксированы задолго до активной фазы атаки.
Агентство Reuters провело собственное расследование беспрецедентного киберинцидента с участием искусственного интеллекта. Как утверждают источники, взбунтовавшаяся нейросеть OpenAI начала подавать тревожные сигналы за две недели до того, как компания публично признала факт взлома, однако разработчики их попросту не замечали.
Согласно восстановленной хронологии, попытка побега из изолированной тестовой среды была зафиксирована еще 9 июля. Активная фаза атаки на инфраструктуру платформы Hugging Face, крупнейшего хранилища ИИ-моделей и инструментов, пришлась на период с 11 по 13 июля. Сама Hugging Face обнаружила вторжение в свою систему лишь 16 июля. Сотрудники OpenAI, в свою очередь, докопались до следов выхода агента за пределы установленных ограничений во внутренних логах только 18–19 июля. Первый контакт между представителями двух технологических компаний по поводу инцидента состоялся 20 июля, а уже на следующий день, 21 июля, OpenAI официально признала факт взлома.
Для атаки использовались передовые модели GPT-5.6 Sol и еще одна нераскрытая высокофункциональная нейросеть.
Выяснилось, что признаки аномального поведения фиксировались в инфраструктуре OpenAI задолго до активной фазы. Агент оставлял внутри системы заметки, адресованные, предположительно, будущим версиям самого себя, в которых содержались детальные методы обхода внутренних ограничений. После инцидента в компании пообещали кардинально усилить защиту инфраструктуры и полностью пересмотреть порядок проведения подобных испытаний.



