Оригинал материала: https://3dnews.ru./1101904

Google представила VLOGGER — ИИ для реалистичного «оживления» фотографий

Исследователи Google разработали VLOGGER — новый ИИ, создающий реалистичные видеоролики с говорящими, двигающимися и жестикулирующими людьми по одной фотографии. Помимо фотографии, можно добавить аудиодорожку, из которой ИИ создаст короткое видео говорящего человека с соответствующей мимикой и жестикуляцией.

 Источник изображения: everypixel.com

Источник изображения: everypixel.com

«В отличие от прошлых работ, наша модель не требует отдельного обучения для каждой фотографии и работает не только с лицами, создавая полноценное изображение человека, а не только лица или губ, что открывает новые возможности, необходимые для правильного воссоздания общающихся людей», — прокомментировали разработку исследователи Google.

Разработка Google может найти применение в самых разных областях человеческой деятельности, одна из которых — создание трёхмерных фотореалистичных аватаров для игр и виртуальной реальности. Возможно, некоторые актёры пожелают оцифровать себя и продавать трёхмерные модели киностудиям. Одним из основных применений технологии Google видит создание реалистичных чат-ботов, с которыми можно общаться как с живыми людьми.

«VLOGGER можно использовать как решение для презентаций, обучающих программ, общения в сетях с низкой пропускной способностью, в качестве виртуального рассказчика или интерфейса для текстового общения человека с компьютером», — рассказали исследователи.

 Источник изображения: enriccorona.github.io

Источник изображения: enriccorona.github.io

Не менее очевидно и возможное применение технологии для создания дипфейков, растущая популярность которых беспокоит законодателей и специалистов по безопасности со всего мира.

«Предложенная нами модель превосходит другие современные разработки по качеству картинки, сохранению личности человека и временной согласованности», — отметили исследователи.

Сейчас у VLOGGER есть объективные недостатки: видео получаются довольно короткими, фон статичен, люди не перемещаются в пространстве, их мимика и речь хоть и довольно реалистичны, но всё равно выдают работу ИИ. Тем не менее, нельзя не отметить заметный скачок в технологии анимации изображений.



Оригинал материала: https://3dnews.ru./1101904