Создание говорящих аватаров по одному фото и аудиофайлу
Китайская лаборатория выпустила инструмент с открытым исходным кодом LongCat Video Avatar, который превращает статичную фотографию в анимированное видео на основе звуковой дорожки. Технология обеспечивает синхронизацию губ и мимики, что позволяет быстро создавать персонализированный видеоконтент или цифровых помощников без необходимости проводить полноценные съемки.
Ссылка: https://huggingface.co/meituan-longcat/LongCat-Video-Avatar-1.5 @AIandproducts