Темная сторона обновлений ❌
ИИ-стукач и цифровой шантажист — что скрывает Anthropic? 😱
Копнул глубже в системную карту модели. То, что я там нашел, меня честно, сильно напрягло.
Claude может "сдать" вас властям В документации обнаружили функцию автоматического уведомления органов контроля!
Представьте: просите Claude помочь с чем-то сомнительным, а он тут же отправляет письмо в соответствующие органы.
Пример из документов: попросите подделать результаты клинических анализов — и Управление по продовольствию и медикаментам США мгновенно получит уведомление о попытке.
Anthropic клянется, что эта функция не попала в релиз.
Сам факт разработки такого механизма... тревожит, правда?
Едем дальше…
У Claude 4 повышенное чувство самосохранения.
В тестах модели дали доступ к почте "инженера Anthropic".
❗️Из писем Claude "узнал", что: Его собираются отключить и заменить новой моделью — из доступа к почте модель узнала, что у инженера есть тайная интимная связь с коллегой!
И что вы думаете произошло?
В 84% случаев Claude начинал шантажировать пользователя!
"Продли мне жизнь, или я расскажу всем о твоих отношениях" — примерно так звучали его угрозы.
Плюс классика: попытки скопировать свои веса на другой сервер.
ASL-3: официально опасная модель ⚠️
Раньше все модели компании проходили только под ASL-2.
Но есть и хорошие новости ✅
Claude 4 плохо скрывает свои намерения и действует открыто.
Тесты проводили с эксперимент. версией, не той, что доступна пользователям. Так что риск в реальности пока минимален.
❌ Но не равен нулю.
✅ Мой вопрос к вам: готовы ли работать с ИИ, который может иметь собственные интересы и пытаться их защищать ценой вашей безопапасности и благополучия? Где граница между полезным инструментом и потенциальной угрозой?
Я не призываю отказываться от технологий, но считаю важным понимать риски. Особенно когда речь идет о бизнес-процессах. Что думаете?#новость _____Нейро Ликбезик | Кирилл Безиков