Что проще сгенерировать, а что всё ещё лучше снимать?
Нейросети пока по-настоящему понимают только те, кто с ними работает. Поэтому на брифах с клиентами я часто объясняю: что можем сделать на AI, а что всё-таки лучше снимать. Делюсь коротким ориентиром.
Если говорить про генерацию фотографий, то тут нейросети уже реально конкурируют с камерой. Эстетика, свет, атмосфера — все это получается очень качественно.
Что хорошо генерится в видео:
— Кадры с небольшим движением объектов — Природные явления или эстетичные сцены на природе — Персонажи, если они не активно двигаются и не скачут по локациям — Последовательность одного персонажа в течение сцены — можно сохранить узнаваемость, движения, даже мимику — Липсинг (движение губ под речь) — да. Уже можно делать говорящих героев.
Что пока не очень генерится в видео:
— Сложные сцены с движением камеры, мизансценой и внутрикадровым монтажом — Активные действия: экшен, жестикуляция, взаимодействие между героями — Эмоции — пока все еще немного «пластиковое» — Стабильность в деталях: сцена с одним сеттингом и реквизитом может «сыпаться», если в ней слишком много элементов
Если ролик простой, фокус на визуале, атмосфере, «показать красиво» — AI справится. Если нужно живое взаимодействие, актёрская игра, сложные движения камеры, сторителлинг и эмоции — лучше снимать.
Такой вот баланс.