Я думаю, мы ещё много раз будем спорить о том, кто у кого что слизал с помощью нейросетей. И чем дальше, тем сложнее будет понять, что именно мы вообще сравниваем.

Вот есть sref, ну допустим, давайте на таком примере. Его кто-то сделал, очевидно же? Потратил время, собрал нужные изображения, нашёл сочетание, которое даёт определённую стилистику. Потом этот sref использует другой человек, генерирует на нём исходник, меняет персонажей, добавляет типографику.

А третий вообще ничего этого не делает. Он ставит задачу агенту, агент сам находит подходящий sref, сам генерирует, сам таскает результат между инструментами, сам собирает финальную работу.

И как-бы есть вопросик, на который я правда пока не знаю ответа. Где во всей этой цепочке находится авторство?

У того, кто нашёл стилистику и сделал sref? У того, кто использовал его как исходник и дальше построил на нём свою работу? У того, кто вообще не видел sref, но поставил задачу агенту, который его использовал?

Давайте так, sref ведь тоже не возникает из вакуума, в его основе уже лежит какой-то визуальный материал. Получается, что это довольно смешная матрёшка, а внутри неё мы пытаемся найти первого человека, после которого можно поставить флажок «пизжено»?

Но где? Мне кажется, раньше в разговорах о слизывании у нас хотя бы была понятная точка отсчёта. Есть работа А, далее появляется подозрительно похожая работа Б. Можно положить рядом и обсуждать композицию, идею, характерные элементы, типографику, детали. Иногда совпадение настолько специфическое, что вопросов особенно не возникает.

Теперь между А и Б может стоять ещё полтехнологическая цепочка. Человек мог вообще не видеть работу А, а просто использовать sref, сделанный кем-то третьим на её основе или агент мог найти этот sref сам. На выходе мы всё равно получаем очень похожую работу.

Это плагиат? А если человек не знал источник? Для результата это что-нибудь меняет? А для оценки его действий? И по каким параметрам мы вообще теперь собираемся определять понятие «слизали»?

По стилю? Тогда насколько стиль может принадлежать одному человеку? По композиции? По набору приёмов? По сочетанию приёмов? По конкретным объектам? По общей похожести?

А сколько должно совпасть одновременно, чтобы возникло ощущение, что перед нами конкретная чужая работа?

Раньше, чтобы очень точно воспроизвести чей-то визуальный язык, его как минимум приходилось изучить и научиться воспроизводить. Теперь между «мне нравится, это круто» и «сделай мне ещё пятьдесят штук примерно так» может пройти несколько минут. И, возможно, именно поэтому нас так массово клинит.

А дальше станет ещё веселее, потому что агенты вообще убирают из этой истории часть человеческого намерения. Если я сама нашла чужой sref и сознательно решила его использовать — одна ситуация.

Если я сказала агенту «сделай мне афишу вот с таким настроением», а он сам нашёл этот sref, использовал его, прогнал результат через несколько моделей и принёс мне готовое — очевидно другая.

Хотя на выходе картинки могут быть неприлично похожими. Поэтому мне кажется, что «похож / не похож» скоро станет совсем недостаточным способом обсуждать такие вещи?

Придётся каким-то образом различать источник, намерение, степень переработки и сам результат, но лично я пока что совершенно не представляю как.

Кто знает, где заканчивается «мы начали с одного» и начинается «ты сделал то же самое»? Здесь у меня пока нет никакого сносного ответа. И подозреваю, что универсального не будет.

Есть ощущение, что считать проценты совпавших пикселей явно бессмысленно, а всё остальное снова возвращает нас к очень человеческим вещам типа замысла, характерных решений, контекста, степени переработки и, вероятно, очень субъективному, но не менее странному ощущению, когда смотришь на работу и сразу понимаешь «ну нет, дружок, вот это ты всё-таки спиздил». А тут опять будет субъективно.

Че думаете? У меня ответа нет