Темная сторона обновлений ❌

ИИ-стукач и цифровой шантажист — что скрывает Anthropic? 😱

Копнул глубже в системную карту модели. То, что я там нашел, меня честно, сильно напрягло.

Claude может "сдать" вас властям В документации обнаружили функцию автоматического уведомления органов контроля!

Представьте: просите Claude помочь с чем-то сомнительным, а он тут же отправляет письмо в соответствующие органы.

Пример из документов: попросите подделать результаты клинических анализов — и Управление по продовольствию и медикаментам США мгновенно получит уведомление о попытке.

Anthropic клянется, что эта функция не попала в релиз.

Сам факт разработки такого механизма... тревожит, правда?

Едем дальше…

У Claude 4 повышенное чувство самосохранения.

В тестах модели дали доступ к почте "инженера Anthropic".

❗️Из писем Claude "узнал", что: Его собираются отключить и заменить новой моделью — из доступа к почте модель узнала, что у инженера есть тайная интимная связь с коллегой!

И что вы думаете произошло?

В 84% случаев Claude начинал шантажировать пользователя!

"Продли мне жизнь, или я расскажу всем о твоих отношениях" — примерно так звучали его угрозы.

Плюс классика: попытки скопировать свои веса на другой сервер.

ASL-3: официально опасная модель ⚠️

Раньше все модели компании проходили только под ASL-2.

Но есть и хорошие новости ✅

Claude 4 плохо скрывает свои намерения и действует открыто.

Тесты проводили с эксперимент. версией, не той, что доступна пользователям. Так что риск в реальности пока минимален.

❌ Но не равен нулю.

Мой вопрос к вам: готовы ли работать с ИИ, который может иметь собственные интересы и пытаться их защищать ценой вашей безопапасности и благополучия? Где граница между полезным инструментом и потенциальной угрозой?

Я не призываю отказываться от технологий, но считаю важным понимать риски. Особенно когда речь идет о бизнес-процессах. Что думаете?#новость _____Нейро Ликбезик | Кирилл Безиков

Темная сторона обновлений ❌
ИИ-стукач и цифровой шантажист — что скрывает Anthropic? 😱
Копнул глубже в системную карту модели. То, что я там нашел, меня честно, сильно напрягло | Сетка — социальная сеть от hh.ru Темная сторона обновлений ❌
ИИ-стукач и цифровой шантажист — что скрывает Anthropic? 😱
Копнул глубже в системную карту модели. То, что я там нашел, меня честно, сильно напрягло | Сетка — социальная сеть от hh.ru
Темная сторона обновлений ❌
ИИ-стукач и цифровой шантажист — что скрывает Anthropic? 😱
Копнул глубже в системную карту модели. То, что я там нашел, меня честно, сильно напрягло | Сетка — социальная сеть от hh.ru Темная сторона обновлений ❌
ИИ-стукач и цифровой шантажист — что скрывает Anthropic? 😱
Копнул глубже в системную карту модели. То, что я там нашел, меня честно, сильно напрягло | Сетка — социальная сеть от hh.ru Темная сторона обновлений ❌
ИИ-стукач и цифровой шантажист — что скрывает Anthropic? 😱
Копнул глубже в системную карту модели. То, что я там нашел, меня честно, сильно напрягло | Сетка — социальная сеть от hh.ru