Anthropic - свидетель, но кто следующий? Anthropic выложил отчёт о том, как его модель пытались использовать для атак. Декабрь 2025 – август 2026, семь направлений: кибероперации, слежка, операции влияния, оружие, биология, мошенничество, кража моделей. Читается как сводка происшествий. По сути это отчёт поставщика услуг о своих клиентах.

Четыре детали в нём интереснее самих инцидентов. 1. Модель оценивает задачу в момент, когда её ставят. В нескольких эпизодах она отказалась: не стала называть конкретных людей боевиками, распознала подготовленное досье как материал для диффамации. Заказчик переформулировал мягче и продолжил работу. Оценка есть, она работает, и она обходится. 2. Аккаунты блокируют. Без процедуры, без состязательности, без мотивировки. Провайдер сам обнаружил, сам квалифицировал, сам применил меру. 3. Сведениями делятся с властями и с отраслью – по усмотрению провайдера, так это и описано. В публичной части отчёта лежат IP-адреса, домены, идентификаторы телеграм-ботов, псевдонимы операторов, город и вуз, где учились двое участников. Это уже не аналитика. Это материал. 4. Часть нападавших работала на чужих ключах доступа, украденных у обычных компаний. В отчёте отдельно объяснено зачем: чужой ключ даёт не только мощность за чужой счёт, но и прикрытие. В логах атака выглядит как действия законного владельца ключа.

Дальше вопросы, на которые в отчёте ответов нет. 1. Если сегодня данные передаются по усмотрению провайдера, сколько пройдёт до момента, когда передача станет автоматической. Не заявление от человека, а машинное извещение по факту. 2. Что происходит, когда система ошиблась. Лексика обсуждения отдельных вопросов устроена так, что любой классификатор напряжётся. Доступ закрыт, работа встала. Ответчик – иностранное юрлицо, решение принял не человек, мотивов нет, стандарт доказывания неизвестен, срок рассмотрения жалобы тоже. Новая категория споров появится здесь сама, без чьего-либо желания, просто потому что случай произойдёт. 3. И объём раскрытия. Когда провайдер решает поделиться, он делится не выводом, а контекстом. Контекст – это переписка, документы, позиция по делу. Всё, что загружают в модель, чтобы она помогла быстрее.

Отдельный вопрос – кто следующий. Сегодня отчёт публикует Anthropic, потому что у него модель и модель читает задачу целиком. Но читает не только модель. Почту читает почтовый сервис. Переписку по сделке и задачи видит корпоративный портал. Документ видит облачный редактор. Разница между ними и моделью пока есть, но завтра ее может быть уже не быть. Кто хранит, отдаёт по запросу. Кто оценивает, может отдать сам.

Разрыв закрывается быстро, потому что ИИ-помощника сейчас встраивают ровно в эти продукты. В почту, в CRM, в портал, в бухгалтерию, в мессенджер. Помощнику для работы нужен доступ ко всему содержимому, в этом весь смысл. Дальше остаётся один параметр настройки: что система делает, когда видит в содержимом признаки правонарушения.

Обязанность хранить переписку и выдавать её уполномоченным органам у сервисов есть давно, это не новость. Новость в том, что появляется техническая возможность не ждать запроса.

Профессиональная тайна строилась и для защиты обывателя и необходимого баланса публичного и личного. Под обыск, под выемку, под допрос. Под ситуацию, когда за информацией приходят снаружи и им можно возразить. Она не рассчитана на то, что носитель информации сам решит, что пора кому-то рассказать.

Отчёт при этом честный, и хорошо, что он опубликован. Обычно такое не публикуют вовсе.

Называется он «обнаружение и противодействие». Читается как «наблюдение и уведомление».

Пока разница ещё есть.

#ветров, #бизнес, #рефлексия