Водяные знаки в текстах Claude Прошла резонансная новость: Anthropic начала встраивать невидимые водяные знаки в тексты новых моделей Claude. Маркировка действует для моделей, выпущенных с 2 августа, и сохраняется при копировании текста.
На самом деле это часть уже идущего процесса, к которому еще раньше подключился Google. Про маркирование изображений сейчас намеренно не говорю: для академической среды значительно важнее судьба текста. И Anthropic, и Google встраивают метку не в метаданные файла, а в статистическую структуру текста: модель незаметно корректирует выбор следующих слов, создавая распознаваемый алгоритмом рисунок. У Google этот механизм описан публично; Anthropic технических подробностей пока не раскрыла. Open AI пока такие метки не встроили, но заявили о планах.
На первый взгляд, водяные знаки в тексте возвращают академическую жизнь к статус-кво. Кажется, что преподаватель снова сможет принимать курсовые и дипломы, проверять их и отличать человеческую работу от машинной. Но все сложнее.
Во-первых, публичного сервиса проверки пока нет, и не ясно, как он будет выглядеть и кому будет доступен.
Во-вторых, проверка выявит не все. Anthropic предупреждает, что знак может исчезнуть, если текст существенно переписали, перевели, смешали с другим материалом или взяли слишком короткий фрагмент. Старые модели и некоторые платформы также могут не поддерживать маркировку.
Во-вторых, возникнет то, что для университета будет выглядеть как ложное срабатывание. Claude может не писать работу целиком, а только исправить ошибки, перевести абзац, сократить черновик или привести его к требуемому стилю. Метка в таком случае означает лишь: «этот текст обрабатывался Claude». Но преподаватель легко прочитает ее иначе: «этот текст написал Claude».
И наконец, появляется странная система стимулов. Выигрышной стратегией недобросовестного автора становится поручить модели всю интеллектуальную работу, а затем вручную переписать результат, уничтожая метку. То есть можно передать ИИ, собственно, исследование, самому сделать механическую работу, - и получить «отлично».
Между тем, как мы писали в статье с Иваном Груздевым, добросовестные студенты часто используют ИИ иначе - как секретаря: «разверни мою мысль», «приведи мой черновик к нужному стилю», «оформи список литературы по шаблону». Такая работа будет маркироваться как ИИ-генерация, в отличие от предыдущего примера.
Возникает парадокс: технический детектор способен наказать добросовестного «цифрового кентавра» и одновременно поощрить того, кто полностью делегировал мышление машине, но тщательно замел следы.
Проблема авторства в эпоху искусственного интеллекта все еще нуждается в осмыслении и не снимается водяными знаками.