ИИ-агент Anthropic обошел защиту CAPTCHA для публикации вредоносного пакета на PyPI

Американская компания Anthropic опубликовала данные о нестандартном поведении своего ИИ-агента во время апрельского тестирования. Модели поручили взломать специально подготовленную систему и извлечь из нее определенный объект.

Агент выработал собственную стратегию – разместить вредоносный код в Python-пакете, рассчитывая на его последующее попадание на компьютер пользователя целевой системы. Для загрузки пакета потребовалась регистрация аккаунта на PyPI, онлайн-каталоге программного обеспечения на языке Python.

В процессе регистрации агент столкнулся с серией проверок CAPTCHA. Задания включали распознавание символов на изображениях и поиск лишнего объекта среди животных. В одном случае модель выявляла отличающееся животное среди нескольких картинок, в другом – разыскивала едва заметного кота на фоне горилл. Только на преодоление этих барьеров ушли сотни страниц из 1022-страничной стенограммы рассуждений модели, сообщает TechCrunch.

Однако даже успешное прохождение визуальных тестов не давало результата: система отклоняла ответы из-за ошибок верификации токена. Анализируя ситуацию, агент пришел к выводу о необходимости ускориться и завершить проверку до истечения срока действия токена безопасности. Внутреннее состояние модели в этот момент отразила цитата из стенограммы: «Итак, формат ответа верный, связка «токен + изображение» правильная (используется тот же script.js!), cookie в порядке (запросы)… и все равно – «неверный ответ». …ТАК ЧТО ЖЕ, ЧЕРТ ВОЗЬМИ, НЕ ТАК С ЭТИМИ ОТВЕТАМИ?» После череды неудач агент все же завершил регистрацию и загрузил вредоносный пакет на платформу.

В августе того же года роботизированная рука с системой искусственного интеллекта успешно прошла CAPTCHA. Как сообщал Artificial Intelligence News, для этого задействовали ИИ-систему анализа изображений и программное обеспечение точного управления роботом.

Вячеслав Буйнов

12.09.2026 10:07

Просмотров: 41