ИИ, которого побоялась выпускать сама Anthropic, хакерам почти не пригодился

ИИ, который создатели назвали слишком опасным для публики, нашёл 225 дыр в программах, а хакеры воспользовались только одной. Эту цифру, как пишет The Register, вывел исследователь Патрик Гэррити из VulnCheck, компании, которая отслеживает реальные атаки хакеров.

В апреле Anthropic, одна из крупнейших компаний-разработчиков ИИ, объявила проект Glasswing. Компания заявила, что её новая модель Mythos ищет уязвимости лучше почти всех людей. Выпускать её для всех сочли слишком рискованным. Доступ дали только проверенным партнёрам. Они ищут и чинят дыры в собственных программах.

Гэррити отнёсся к этому скептически с самого начала. Ещё в апреле он сомневался, сколько уязвимостей проект нашёл на самом деле. Потом завёл список всех дыр, связанных с Anthropic и получивших номер CVE. Так называется общий мировой реестр уязвимостей. Этот список он сверил с базой дыр, которые уже используют злоумышленники.

На 21 сентября в списке 225 уязвимостей. В атаках замечена одна. Это ошибка в Ghost, платформе для блогов и онлайн-изданий, через которую можно подсунуть свою команду прямо в базу данных сайта. Меньше 0,5% от всех находок.

Гэррити считает, что между найденной дырой и полезной для атаки дырой огромная дистанция. По его словам, уязвимости от Anthropic по последствиям не отличаются от случайной выборки любых других. Список при этом смешанный. В него попали находки и самой модели, и исследователей компании, и её партнёров.

Закрытый доступ защищает Anthropic не только от хакеров. Модель получили проверенные партнёры под конкретную задачу и на договорных условиях. Если с её помощью что-то сломают, первым делом будут разбирать их договор и их действия. Выпусти компания Mythos для всех, вопрос об ответственности за каждый взлом, скорее всего, встал бы к ней самой. Осторожность здесь заодно и юридическая страховка.

А вот чинить ИИ пока умеет хуже, чем искать. Лаборатория Off-by-1 из компании 1Password проверила модели GPT-5.5 и Opus 4.8. Полностью закрыть уязвимость им удалось только в 26% случаев. В 54% они либо не справлялись, либо добавляли новую дыру. Гэррити говорит, что ИИ сильно упростил поиск уязвимостей, а всё остальное, от выбора самых срочных до выпуска исправлений, по-прежнему держится на людях.

ИИ научился находить дыры быстрее людей. Закрывать их всё равно приходится людям.

—

Телеграм про право в IT и AI. IT юристы — PravoWeb.com

Ещё почитать