Может ли ИИ, сняв десять красивых кадров, выдать готовый фильм?

В первом кадре герой в черной куртке, в третьем у него внезапно меняется лицо, а когда мы возвращаемся в комнату, меняется и расположение двери. Каждый фрагмент четкий, но вместе их использовать невозможно — именно это обходится особенно дорого при создании длинных видео.

Google запланировала демонстрацию Co-Director на конференции COLM, которая пройдет с 6 по 9 октября. В сочетании с исследованием, опубликованным 24 сентября, она посвящена комплексному планированию историй из нескольких кадров. Связанная с ней система CANVAS постоянно отслеживает состояние персонажей, мест и предметов, чтобы сцена, появляющаяся снова после нескольких кадров, могла органично продолжаться.

Прогресс здесь касается связности между кадрами, а включение демонстрации в программу конференции не означает, что проект уже приносит коммерческий доход. Одиночная генерация обходится дешевле, но если потом ради исправления одной детали одежды приходится переделывать половину фильма, стоимость готового результата все равно может быть высокой.

Я обращаю внимание на то, сохраняется ли последовательность, когда персонаж уходит и возвращается, соответствуют ли изменения реквизита сюжету и не ломает ли правка предыдущей сцены последующую. Если система стабильно проходит эти проверки, производственным командам будет проще перенаправить бюджет с ручных исправлений на полноценное производство.

Изучая направления ИИ-вычислений и интеллектуальных агентов, в том числе RENDER, FET и NEAR, также нужно следить за реальным внедрением и результатами работы; здесь нет доказательств их участия в проекте Google.

На втором изображении — справочное фото здания Google, а не место проведения конференции.

$RENDER $FET $NEAR

Нажмите на мой аватар, чтобы посмотреть мой реальный торговый счет