Новая open-source модель создает говорящие аватары из одного фото

Библиотека LongCat-Video-Avatar позволяет превратить обычную фотографию и аудиозапись в реалистичное видео с говорящим персонажем. В отличие от аналогов, эта модель оптимизирована для длинных видео, поддерживает взаимодействие нескольких персонажей и обеспечивает стабильную синхронизацию движения губ.

Инструмент имеет лицензию MIT, что позволяет бесплатно использовать его в коммерческих целях для создания цифровых аватаров в электронной коммерции, обучении и маркетинге.

Ссылка: https://github.com/meituan-longcat/LongCat-Video @AIandproducts