Ученые AIRI улучшили ИИ-стилизацию фотографий и выложили алгоритм в открытый доступ
Современные подходы к инверсии изображений делятся на две группы: методы, основанные на оптимизации и на базе энкодеров. В одном случае это быстрый, но не очень точный метод, в другом — медленный, но хороший. И везде остается риск изменения исходного изображения.
Ученые AIRI решили эту проблему благодаря новой процедуре обучения. На первом этапе нейросеть учится реконструировать фотографию без редактирования – правильно получать из изображения нужные ей признаки. На втором этапе она учится правильно редактировать выученные признаки. В этом ей помогают предыдущие методы — с помощью них можно собрать примеры редактирований простых изображений.
Таким образом команда показывает своему методу, как реконструировать сложные (реальные) фотографии, как должны редактироваться простые (синтетические), и нейросеть сама начинает понимать, как редактировать сложные фото.