Как не споткнуться о 152-ФЗ, работая с ИИ
Играясь с ИИ, вы помните про персональные данные, когда отправляете в ИИ договор или заявки клиента?
Не буду писать огромный пост, их написано уже сотни Просто почитайте вот это https://habr.com/ru/amp/publications/1057128/
Это не пост юриста, это статья айтишника, к.т.н. и преподавателя ИТ-дисциплин Про штрафы: За незаконную обработку персональных данных — до 700 тысяч рублей. За утечку — уже от 3 до 15 миллионов, а если утекла биометрия, то до 20.
Что вообще можно отправлять в ИИ, а что нет: ⭐️Можно спокойно: обезличенные тексты без ФИО и реквизитов; шаблоны договоров и регламентов; всё, что и так лежит в открытом доступе на сайте; код и документы, в которых нет ни тайн, ни персданных.
🚫Нельзя категорически: персональные данные клиентов и сотрудников; договоры с реквизитами физлиц; бухгалтерию с банковской и налоговой тайной; и вообще любой документ под грифом коммерческой тайны.
При создании продуктов, внедрении автоматизации и даже простеньких агентов я всегда в первую очередь думаю о безопасности. Решений может быть множество, зависят от бюджета и задачи:
• Локальные GPT-модели: разворачиваются строго внутри вашего закрытого контура, откуда данные физически не могут уйти в интернет. • LLM-файрволы: софт, который в моменте ловит в тексте имена, телефоны и коммерческую тайну, меняет их на заглушки и только потом отправляет в ИИ. • Российские облака (152-ФЗ): работайте через API отечественных моделей (YandexGPT, GigaChat), развернутых на серверах в РФ со всеми нужными аттестатами безопасности.
В общем, играть с ИИ — круто, но играть по правилам однозначно дешевле)
Пользуясь случаем, приглашаю вас в свой тг: вам не сложно, а мне - приятно) https://t.me/place_it
· 09.07
Не надо говорить что если данные утекли в Яндекс это допустимо. Яндекс, как и Сбер с ГигаЧат имеют такие же права ( то есть не имеют ) что и ChatGPT и DeepSeek. Все они находятся во вне и все они будут не только обрабатывать все что им пришло, но и учится на основе того что вы им отдали. А учится, это значит накапливать. И они спокойно могут выдать инфу что была передана Вами, другому пользователю если он пришел с аналогичным запросом.
0
ответить
коммент скрыт — часть юзеров считает его токсичным или некорректным
коммент удалён
· 09.07
Очень классный коммент, спасибо)
Вы правы, если мы говорим про обычные чат-боты. Но я писала именно про интеграцию ИИ в бизнес-продукты и процессы через коммерческий API.
Что касается обучения моделей на данных: у Яндекса в документе «Аспекты безопасности в Yandex Foundation Models» указано, что при работе через API логирование запросов можно полностью отключить. В этом случае данные клиентов не используются для обучения моделей и не сохраняются в логах сервиса.
А у OpenAI данные не собираются для дообучения по API по умолчанию, но можно самостоятельно включить) Но главная проблема всё же сегодня это вопрос передачи персональных данных зарубеж.
А то, что мы как физлица свои данные в чатики постоянно отправляем, загружаем медицинские документы, договора на изучение и тд - это уже наша ответственность, мало кто знает про обучение на наших данных.
0
ответить
коммент скрыт — часть юзеров считает его токсичным или некорректным
ответ удалён
· 09.07
Да вот вопрос в случае Яндекса ПДН где обрабатываются? Мои? А я им согласия на обработку не давал. И мне все равно будут они легировать или только будут говорить что не будут логировать. Они их будут ОБРАБАТЫВАТЬ!!!!
0
ответить
коммент скрыт — часть юзеров считает его токсичным или некорректным
ответ удалён
· 09.07
В описанном мной случае пользователь как раз взаимодействует с компанией, которая оказывает ему, например, услугу. Именно она является оператором персональных данных и принимает решение, какую инфраструктуру использовать для их обработки, при условии соблюдения требований 152-ФЗ.
Собственно, об этом и мой пост: если компания внедряет ИИ в свои процессы, она должна заранее продумать законность обработки персональных данных и выбрать подходящее решение)
0
ответить
коммент скрыт — часть юзеров считает его токсичным или некорректным
ответ удалён