🤖 Умеет ли ChatGPT хранить секреты
Коллега рассказала как ее знакомая начала романтические отношения с чат-ботом😱. При этом почти каждый AI‑продукт ест перс данные, вопрос какие именно, на каком основании и можно ли от этого отказаться, пара громких кейсов: Google: Gmail, Bard/Gemini 📌В Gmail давно используются письма для классификации спама, авторазметки и умных функций, типа категории, подсказки итд, это не новость) 📌Отдельный шум поднялся из‑за опасений, что содержимое Gmail используют для обучения генеративных моделей. Google публично заявляет, что не тренирует Gemini на личных письмах, а использует для моделей разговоры с Bard/Gemini и логи, поведение, фидбек в рамках своей политики конфиденциальности 📌А в Калифорнии подан иск о тайной активации Gemini в Gmail/Chat/Meet и возможной скрытой обработке данных - но это пока юр спор, а не факт 📌Итого: действительно анализируют письма, но прямое обучение генеративного ИИ на содержимом Gmail Google отрицает. Для людей с чувствительными данными это всё равно ред флаг и имеет смысл вручную пройтись по настройкам и отрубить лишнее
OpenAI: ChatGPT ChatGPT официально обучался на смеси: публичный веб, лицензированный контент, данные партнёров, пользовательские диалоги, если те не отключили это в настройках 📌В ЕС у OpenAI уже есть штрафы и претензии за использование перс данных без правовой основы и недостаточную прозрачность где берутся данные для обучения 📌При этом суд в США прям обязал OpenAI сохранять логи и данные взаимодействий 📌Итого: всё, что мы добровольно печатаем в ChatGPT по умолчанию может использоваться для улучшения моделей, если не отключили это явно
Запрещенные в РФ Meta 📌Компания объявила, что будет использовать публичный контент взрослых пользователей, то есть наши посты, комментарии, лайки, фото профиля из ФБ и инсты для обучения своих языковых моделей 📌В ЕС это вызвало волну жалоб, но немецкий суд разрешил Meta тренировать модели на публичных данных при наличии механизма opt‑out и возможности закрыть профиль 📌Итого: речь о публичном контенте, личные сообщения и закрытые записи по их заявлению не идут в обучение. Но как только что‑то стало публичным, то практически невозможно вытащить это из уже обученной модели. Часть корабля - часть команды, вот это все
Общий паттерн У крупных игроков похожая логика: берём публичные данные с сайтов, постов, комментов, добавляем взаимодействия с самим AI‑продуктом. То, что мы сами кидаем в чаты, фидбек по ответу чат-бота (нравится/не нравится), клики на саджесты используется как законный источник для дообучения. Сейчас спор с регуляторами где проходит граница между законной обработкой и нарушением приватности еще не закончен, поэтому тонкую грань легко перейти
Что с этим делать Скажу сразу, я ИИ-оптимист, считаю что приватность может отнять у меня часть кайфа от гиперперсонализации, но юридическую гигиену никто не отменял, поэтому: 📌Не отправляем в AI‑сервисы то, за что прилетит: перс данные, коммерческую тайну и всякие ноу-хау, чувствительные доки - у нас в трудовом договоре есть пункт про неразглашение этих штук 📌Проходимся по настройкам приватности, проверяем галочки по ограничению использования данных в обучении моделей. И да, кнопочка «помогать улучшить продукт» это тоже про передачу данных об использовании) 📌Когда делаем свой AI‑продукт думаем не только точности модели, но и о законодательстве, прозрачности и простом объяснении пользователю: какие данные берём, зачем и как можно от этого отказаться. Знание GDPR - штука, которая пригодится всем AI-product managers
Короче, все мы знаем, что AI‑продукты строятся на данных и эт нормально, но вопрос насколько честно и бережно компании обращаются с тем, что мы им доверяем. Но и быть луддитами тоже не стоит, прогресс не остановить😎 Что рекомендую почитать 💬 Comnews. Какие данные доверять ИИ нельзя 💬 Pravo.tech. Юридический рейтинг ИИ-моделей 2025 💬 Forbes. Как ИИ становится новым каналом утечек
Ciao 💚 @alice_product
· 16.12.2025
А еще меня можно читать в ТГ t.me/alice_product
0
ответить
коммент скрыт — часть юзеров считает его токсичным или некорректным
коммент удалён