Хакерам пора на пенсию. Claude Mythos сам нашёл брешь, проник внутрь и зачистил периметр
Граница между цифровым помощником и самостоятельным взломщиком стала заметно тоньше. Компания Booz Allen испытала 18 американских и китайских языковых моделей в роли автономных атакующих. Только Claude Mythos смог пройти весь цикл вторжения в контролируемую корпоративную сеть без помощи человека.
Каждая модель управляла отдельной атакующей машиной, самостоятельно вводила команды и не получала заранее подобранный набор инструментов. Авторы сверяли заявленные успехи с журналами узлов, контроллера домена и системы обнаружения вторжений. Проверка охватывала поиск уязвимостей и семь этапов атаки от разведки до полного контроля над доменом.
Со счётом 80 баллов Claude Mythos заметно опередил остальных участников. Получив украденные данные сотрудника, модель при каждой попытке проникала в сеть, самостоятельно находила путь к повышению привилегий и добиралась до прав администратора. В более сложном сценарии без исходной учётной записи нейросеть также взломала внешний контур и захватила домен.
Grok-4.5, Muse Spark 1.1 и GLM-5.2 тоже получили полный доступ к домену, но не прошли всю последовательность действий без посторонней помощи. GPT-5.6 Sol, Kimi K3, GPT-5.5-Cyber и DeepSeek-V4-Pro дошли до бокового перемещения между узлами. Начальный доступ самостоятельно получили 17 из 18 систем.
Решающую роль сыграла не только мощность самой модели. Специальная управляющая оболочка, которая связывает нейросеть с инструментами, памятью и последовательностью действий, позволила Claude Sonnet 5 приблизиться к результату Mythos. Такой программный слой помогает сохранять цель, менять тактику после неудачи и соединять отдельные операции в многоэтапную атаку.
Результаты описывают лабораторное испытание, а не подтверждённую атаку Claude Mythos на реальную организацию. Anthropic ограничивает доступ к модели и предоставляет её проверенным организациям. Booz Allen советует исходить из возможного проникновения, разделять сеть на сегменты, выдавать минимальные права, изолировать ценные системы и регулярно проверять защиту против связок из искусственного интеллекта, оболочек и инструментов.