Компания Anthropic выпустила новуб модель - Claude Mythos Preview. И это, похоже, первый реально тревожный сигнал, что ИИ в кибербезопасности вышел на новый уровень.

Anthropic говорят, что это модель общего назначения: её не затачивали специально под взлом. Но вместе с ростом навыков в кодинге, логике и автономной работе у неё резко выросли и способности находить и эксплуатировать уязвимости.

Именно поэтому модель не выпустили публично. Вместо этого Anthropic запустили Project Glasswing: ограниченный доступ для крупных партнёров и ещё 40+ организаций, которые занимаются защитой критического ПО и инфраструктуры. Под это они выделяют до $100 млн usage credits.

По словам Anthropic, Mythos Preview уже нашла тысячи уязвимостей высокой опасности, в том числе в каждой основной ОС и во всех основных браузерах. Причём модель умеет не только находить баги, но и автономно превращать их в рабочие эксплойты.

Три публичных примера после патча:

27-летняя уязвимость в OpenBSD; • 16-летняя уязвимость в FFmpeg, которую автоматические тесты пропускали миллионы раз; • цепочка уязвимостей в ядре Linux, дающая полный контроль над машиной.

Главный вывод: развитие сильных моделей для кода автоматически начинает означать и рост их наступательных возможностей. То есть вопрос уже не в том, сможет ли ИИ массово искать уязвимости, а в том, успеют ли защитники встроить эти инструменты раньше, чем это сделают атакующие. Я люблю наш кибербез и он правда сильный. Но вот ИИ у нас супер слабый в стране.

Компания Anthropic выпустила новуб модель - Claude Mythos Preview. И это, похоже, первый реально тревожный сигнал, что ИИ в кибербезопасности вышел на новый уровень | Сетка — социальная сеть от hh.ru