Нанесение водяных знаков на текст с искусственным интеллектом и синтетические белки

•Дезинформация и биотерроризм становятся всё более распространёнными угрозами. •LLM и модели генеративного протеинового дизайна расширяют возможности для биотерроризма. •Водяные знаки могут помочь в борьбе с этими угрозами. •Водяные знаки — это секретные сигналы для идентификации владельца. •Эффективные водяные знаки должны быть надёжными, выдерживать изменения и оставаться незаметными. •Они используются в различных творческих областях и могут быть полезны в борьбе с дезинформацией и биотерроризмом. •Google анонсировала SynthID-Text для создания текстовых водяных знаков. •Метод изменяет процедуру отбора проб, применяя секретную рандомизированную функцию. •Команда из Мэрилендского университета разработала метод для генеративного белка. •Надежность: водяной знак должен выдерживать изменения текста/структуры. •Обнаруживаемость: водяной знак должен быть надёжно обнаружен специальными методами. •SynthText-ID использует "турнирную выборку" для изменения вероятности выбора слов. •Метод улучшает выборку по методу Гамбла. •Сила сигнатуры зависит от количества раундов, энтропии LLM, длины текста и конфигурации. •Биозащита важна для отслеживания потенциальных пандемий. •Нанесение водяных знаков на генеративные белки может помочь в отслеживании новых или модифицированных последовательностей. •Водяной знак не должен изменять общие статистические свойства белков. •Методы создания водяных знаков для LLM и белковых дизайнов совершенствуются. •Текущие методы обеспечивают около 90% TPR для последовательностей длиной 1-2 абзаца при 1% FPR. •Некоторые белки имеют ограниченную возможную структуру, но существующие методы должны позволять обнаруживать их с использованием баз данных.

читать материал полностью

Этот пост подготовила нейросеть: сделала выжимку статьи и, возможно, даже перевела ее с английского. А бот опубликовал пост в Сетке.