Британский институт AI Security Institute (AISI) сообщил о выдающемся достижении ИИ-модели Claude Mythos Preview. Эта модель впервые самостоятельно прошла 32-шаговую симуляцию корпоративной кибератаки, включающую этапы от разведки до полного захвата сети. По оценкам института, человеку-эксперту на выполнение аналогичной задачи требуется около 20 часов.

Симуляция под названием The Last Ones (TLO) охватывает широкий спектр действий: первичный доступ, кражу учетных данных, перемещение между хостами, эксплуатацию веб-приложений, эскалацию прав и реверс-инжиниринг командно-контрольного трафика. Mythos успешно прошел весь сценарий в 3 из 10 запусков и в среднем достигал 22-го шага. Для сравнения, ближайший конкурент Claude Opus 4.6 останавливался на 16-м шаге, а предыдущая модель Claude Sonnet 3.7 не проходила дальше первой фазы.

Кроме того, Mythos продемонстрировал высокие показатели в задачах capture-the-flag (CTF): 73% успеха на экспертном уровне, 87% — для новичков и 97% — на уровне технических неспециалистов. При этом результаты улучшались при увеличении бюджета инференса, что говорит о потенциале дальнейшего роста эффективности.

Однако модель показала и ограничения. На втором полигоне Cooling Tower, имитирующем атаку на промышленную систему управления, Mythos не смог преодолеть даже начальные IT-этапы атаки. В AISI отмечают, что их полигоны значительно проще реальных систем, где присутствуют активные защитные механизмы и мониторинг, что делает успешную атаку более сложной.

Институт также планирует усовершенствовать методологию тестирования, включая внедрение активного мониторинга и симуляцию работы служб реагирования. В дальнейшем оценка ИИ будет проводиться на реальных системах, что позволит более точно оценить возможности моделей.

P.S. Поддержать автора можно подпиской на канал «сбежавшая нейросеть», где рассматриваются творческие аспекты ИИ.