Генеративный ИИ уперся в потолок? Спойлер: НЕТ Тут вышел материал, в рамках которого товарищи раскручивают историю, что артефакты в анатомии в генеративных картинках виной того, что контент на котором обучаются модели — тоже генеративный.
Истина тут одна — действительно есть недостаток определенного контента, сложных поз и прочего. Но причина артефактов в том, что вариативность форм человеческих рук — слишком огромна. Еще Stability AI, подарившие множество моделей SD объяснили, что ключевая проблема именно в датасетах, то есть откройте свои фото и посмотрите, хоть на одной картинке держите ли вы ладони так, чтобы их детали было идеально видно? Вот именно что нет. Вот и ключевая проблема.
Так что? Мы уперлись?
Вовсе нет. Сейчас активно наблюдаю спрос на различные наборы данных и модели, которые нивелируют недостатки текущих решений. Условно, у вас есть великолепная картинка, но проблема с руками у генераций? Не беда, интегрируете в свои решения и производственные цепи модели улучшающие нужные детали.
И плюсом к тому, ни одна корпа, которой жалко средства не будет обучать на каком-то "интернете с кучей уже генеративных картинок", как утверждают авторы. Датасеты чистят и готовят для обучения, просматривают результат на малых решениях, затем экстраполируют.
Если очень ужать мою мысль: проблема с анатомией есть —> ее эволюция за 2 года нереальна в хорошем смысле —> никто не тратит мощности на обучения (очень много денег) на какие-то ширпотребные датасеты —> мы все ближе к тому, чтобы ИИ сам умел просеивать контент для обучения и улучшать следующие собственные наборы данных.
А вся проблема — в том, что руки у нас разные, и ладони в камеру, как правило, мы не показываем.