Восстановление исходных промптов из ответов нейросетей

Разработана новая обратная модель, способная восстанавливать точный текст исходной инструкции пользователя, имея на руках только результат ответа нейросети. Это открытие ставит под угрозу конфиденциальность корпоративных инструментов, работа которых основана на уникальных и сложных промптах.

Фактически, конкуренты или злоумышленники теперь могут реконструировать внутреннюю логику любого публичного ИИ-сервиса.

Ссылка: https://arxiv.org/abs/2607.29378 @AIandproducts