Сегодня 14 октября 2024
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Google представила мощную нейросеть Lumiere для генерации реалистичных видео

Google представила Lumiere«модель пространственно-временной диффузии для реалистичной генерации видео», основанную на искусственном интеллекте. Как показала практика, это, возможно, самый мощный на сегодняшний день ИИ-генератор видео, создающий динамические изображения по текстовому описанию.

 Источник изображения: lumiere-video.github.io

Источник изображения: lumiere-video.github.io

Важнейшим отличием Google Lumiere от существующих аналогов является уникальная архитектура модели — видео по всей его продолжительности генерируется за один проход. Другие модели работают по иному принципу: они генерируют несколько ключевых кадров, а затем производят интерполяцию по времени, что затрудняет согласованность генерируемого ролика. Lumiere работает в нескольких режимах, например, производит преобразование текста в видео, конвертирует статические изображения в динамические, создаёт видеоролики в заданном стиле на основе образца, позволяет редактировать существующее видео по письменным подсказкам, анимирует определённые области статического изображения или редактирует видео фрагментарно — например, может изменить предмет гардероба на человеке.

«Мы обучаем нашу модель T2V [преобразования текста в видео] на наборе данных, включающем 30 млн видеороликов с текстовыми описаниями. Видео имеют длину 80 кадров с частотой 16 кадров в секунду. Базовая модель обучена на разрешении 128 × 128 пикселей», — пояснили в Google. На выходе получаются 5-секундные ролики с разрешением 1024 × 1024 пикселей.

Google Lumiere — конечно, не первый ИИ-генератор видео. Сама Google ранее демонстрировала модель Imagen Video, которая генерировала ролики разрешением 1280 × 768 точек с частотой 24 кадра в секунду, но её творения были намного более скромными. Меньшим реализмом отличались результаты таких проектов как Meta Make-A-Video, Runway Gen2 и Stable Video Diffusion. В Google понимают угрозу, которую могут представлять подобные проекты: «Основная наша цель в этой работе — дать начинающим пользователям возможность генерировать визуальный контент гибко и творчески. Однако существует риск неправомерного [создания] подделок или вредоносного контента при помощи нашей технологии, и мы считаем, что крайне важно разрабатывать и применять инструменты выявления случаев предвзятости и злонамеренного использования, чтобы обеспечить безопасную и добросовестную работу [модели]».

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Вечерний 3DNews
Каждый будний вечер мы рассылаем сводку новостей без белиберды и рекламы. Две минуты на чтение — и вы в курсе главных событий.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
«Никакой мишуры, только игры»: Microsoft подтвердила шоу Xbox Partner Preview, где покажут DLC для Alan Wake 2, пиратскую Yakuza и многое другое 2 ч.
В Android скоро можно будет запускать Linux-приложения 3 ч.
Bungie и NetEase анонсировали ролевой шутер Destiny: Rising, но только для iOS и Android 3 ч.
Объявлены системные требования Life is Strange: Double Exposure — для кинематографического погружения нужна RTX 4070 Ti Super, но для запуска хватит и GTX 960 3 ч.
Глава Xbox Game Studios уйдёт из Microsoft после 30 лет работы — объявлен новый руководитель 4 ч.
Создатели John Wick Hex анонсировали изометрический экшен Tron: Catalyst в духе Hades 5 ч.
Вирус-вымогатель атаковал Casio — хакеры украли личные данные клиентов и сотрудников 5 ч.
Postgres Professional инвестирует 3 млрд рублей в развитие экосистемы Deckhouse 5 ч.
Календарь релизов — 14–20 октября: MechWarrior 5: Clans, Unknown 9: Awakening и Neva 5 ч.
Стелс-тактика The Stone of Madness от авторов Blasphemous отправит устраивать побег из испанского монастыря XVIII века— дата выхода и новый трейлер 6 ч.
Kioxia представила SSD серии XD8: PCIe 5.0 в форм-факторе E1.S 2 ч.
По стопам Apple: смартфоны серии Oppo Find X8 получат кнопку управления камерой 3 ч.
Vivo представила смартфон X200 — чип Dimensity 9400, три 50-Мп камеры и батарея на 5800 мА·ч в тонком корпусе 3 ч.
Vivo представила X200 Pro и компактный X200 Pro mini — первые смартфоны на флагманском Dimensity 9400 4 ч.
Apple лишилась права тестировать беспилотные автомобили в Калифорнии 6 ч.
Maxsun представила 12 материнских плат с чипсетом Intel Z890 для процессоров Core Ultra 200S 7 ч.
В Брукхейвенской национальной лаборатории накопилось уже более 300 Пбайт физических данных — это больше, чем вся письменная история человечества 9 ч.
ASRock рекламирует разгон оперативной памяти DDR5 до 10 133 МТ/с на новой плате Taichi Z890 OCF 9 ч.
Китайским дата-центрам слишком сложно и дорого переходить с чипов Nvidia на местные аналоги 10 ч.
HPE представила архитектуру прямого жидкостного охлаждения без вентиляторов 10 ч.