Новая open-source модель создает говорящие аватары из одного фото
Библиотека LongCat-Video-Avatar позволяет превратить обычную фотографию и аудиозапись в реалистичное видео с говорящим персонажем. В отличие от аналогов, эта модель оптимизирована для длинных видео, поддерживает взаимодействие нескольких персонажей и обеспечивает стабильную синхронизацию движения губ.
Инструмент имеет лицензию MIT, что позволяет бесплатно использовать его в коммерческих целях для создания цифровых аватаров в электронной коммерции, обучении и маркетинге.
Ссылка: https://github.com/meituan-longcat/LongCat-Video @AIandproducts