🚀 Новая генеративная интерактивная среда Genie, разработанная командой из Google DeepMind и Университета Британской Колумбии, обещает революционизировать создание видеоконтента! 🎥💥 Genie использует передовые модели генерации видео, основанные на пространственно-временных (ST) трансформерах, чтобы создавать уникальные виртуальные миры по текстовым подсказкам, изображениям и даже эскизам. Система включает в себя три ключевых компонента: модель скрытых действий, видеомаркенизатор и динамическую модель, которые работают вместе, чтобы предсказывать следующие кадры и создавать захватывающий контент. 🌟 Обучение Genie по традиционному конвейеру генерации видео с авторегрессией позволяет создавать высококачественные видеоролики, а также обучать агентов имитировать поведение из различных видеороликов. Это открывает путь к развитию универсальных агентов и новым возможностям в мире генеративного искусства! 🌈✨