Что проще сгенерировать, а что всё ещё лучше снимать?

Нейросети пока по-настоящему понимают только те, кто с ними работает. Поэтому на брифах с клиентами я часто объясняю: что можем сделать на AI, а что всё-таки лучше снимать. Делюсь коротким ориентиром.

Если говорить про генерацию фотографий, то тут нейросети уже реально конкурируют с камерой. Эстетика, свет, атмосфера — все это получается очень качественно.

Что хорошо генерится в видео:

— Кадры с небольшим движением объектов — Природные явления или эстетичные сцены на природе — Персонажи, если они не активно двигаются и не скачут по локациям — Последовательность одного персонажа в течение сцены — можно сохранить узнаваемость, движения, даже мимику — Липсинг (движение губ под речь) — да. Уже можно делать говорящих героев.

Что пока не очень генерится в видео:

— Сложные сцены с движением камеры, мизансценой и внутрикадровым монтажом — Активные действия: экшен, жестикуляция, взаимодействие между героями — Эмоции — пока все еще немного «пластиковое» — Стабильность в деталях: сцена с одним сеттингом и реквизитом может «сыпаться», если в ней слишком много элементов

Если ролик простой, фокус на визуале, атмосфере, «показать красиво» — AI справится. Если нужно живое взаимодействие, актёрская игра, сложные движения камеры, сторителлинг и эмоции — лучше снимать.

Такой вот баланс.

Что проще сгенерировать, а что всё ещё лучше снимать? | Сетка — социальная сеть от hh.ru