«Сбер» научил нейросеть Kandinsky генерировать стикеры и фотореалистичные изображения и портреты

12.07.2023 [19:43], Владимир Мироненко

«Сбер» представил новую версию своей нейросети для генерации изображений по текстовому описанию — Kandinsky 2.2, которая позволит создавать фотореалистичные изображения с более высоким разрешением и изменять соотношение сторон при генерации, а также обеспечит значительный прирост качества при создании портретов.

Генерация Kandinsky 2.2. Источник изображений: «Сбер»

Для дообучения Kandinsky 2.2 использовался набор данных из 1,5 млрд пар «текст — изображение», что на 300 млн больше, чем для предыдущей версии — Kandinsky 2.1, вышедшей в апреле этого года и набравшей всего за 6 дней 2 млн пользователей.

Новую версию модели научили создавать стикеры, из которых можно собирать полноценные стикерпаки в Telegram. Также благодаря внедрению специального структурного блока управляемых изменений ControlNetона она получила способность изменять по текстовому описанию отдельные объекты или элементы на изображениях, сохраняя при этом композицию исходной иллюстрации.

Генерация Kandinsky 2.2

Согласно пресс-релизу, Kandinsky 2.2 понимает запросы на русском и английском языках, обладает способностью рисовать более чем в 20 стилях, смешивать несколько рисунков, стилизовать изображение по текстовому описанию, генерировать изображения, похожие на заданные, а также дорисовывать недостающие части картинки (inpainting) и создавать картины в режиме бесконечного полотна (outpainting).

Стикерпак от Kandinsky 2.2

«Нейросеть уже не просто пытается подражать творчеству человека, а способна создавать новые художественные смыслы и интерпретации», — сообщил первый зампред правления Сбербанка Александр Ведяхин, добавив, что, как и предыдущая версия, Kandinsky 2.2 находится в открытом доступе, и протестировать её можно совершенно бесплатно.

Сообщается, что ознакомиться с возможностями Kandinsky 2.2 можно на промостранице модели, на платформе FusionBrain.AI, в Telegram-боте и боте соцсети «ВКонтакте», а также при помощи команды «Запусти художника» на умных устройствах Sber, в мобильном приложении Салют. Модель доступна на платформе ML Space в хабе предобученных моделей и датасетов DataHub.

Разработкой и обучением нейросети занимались исследователи Sber AI при партнёрской поддержке учёных из Института искусственного интеллекта AIRI на объединённом датасете Sber AI и компании SberDevices.

ИИ-генератор изображений Microsoft Designer вышел в открытый доступ

28.04.2023 [11:59], Павел Котов

Основанный на алгоритмах искусственного интеллекта генератор изображений Microsoft Designer стал общедоступной платформой, испробовать которую может любой желающий — достаточно войти в свой аккаунт системы Microsoft.

Источник изображения: designer.microsoft.com

Работа с Microsoft Designer начинается либо с загрузки собственного изображения, либо с генерации картинки по описанию. Есть также возможность создать слайд с заданным текстом в соответствии с набором шаблонов. Поддерживаются функции редактирования: перед получением окончательного результата можно внести в макет некоторые правки, например, изменить размер или начертание текста. При изменении размера картинки макет подстраивается под новый формат.

Microsoft Designer создан с расчётом на экспорт в социальные сети: шаблоны оптимизированы для выгрузки в Instagram✴ и Facebook✴ — всего около 20 платформ. Нейросеть может помочь в создании описания загруженного пользователем изображения, подобрать хештеги для него или произвести публикацию прямо из Designer.

Генерируемые ИИ изображения сегодня являются своеобразным «Диким Западом» с позиции авторского права — оно признается только в той части работы, которую совершает человек. Любопытно, что Microsoft разделяет эту позицию, заявляя, что не претендует ни на авторство контента, загружаемого пользователями, ни на авторство генерируемых изображений. Корпорация не ограничивает пользователей в коммерциализации этих изображений и, вместе с тем, возлагает на них всю ответственность за принимаемые ими решения по продаже таких картинок.

Microsoft планирует добавить Designer в браузер Edge наряду с инструментом Image Creator. При просмотре лент Twitter или Facebook✴ в Edge и создании публикаций Designer может предложить дополнить их своими изображениями, чтобы оживить её. Кроме того, в планах Microsoft — новые функции редактирования изображений с ИИ. К примеру, можно будет убрать с головы человека корону или заменить её бейсболкой. Появится также функция смены фона, аналогичная той, что уже есть в Adobe Photoshop. Наконец, Microsoft Designer будет работать по freemium-модели: некоторые возможности станут доступными только для подписчиков Microsoft 365.

2 млн пользователей за 6 дней: нейросеть «Сбера» Kandinsky 2.1 оказалась среди самых быстрорастущих сервисов мира

10.04.2023 [17:39], Владимир Фетисов

Стало известно, что бесплатная генеративная модель Kandinsky 2.1, презентация которой состоялась ранее в этом месяце, стала одним из самых быстрорастущих сервисов искусственного интеллекта в мире. Она способна генерировать красочные картинки по текстовому описанию пользователя, а также поддерживает возможность создания работ в разных стилях.

Результат работы алгоритма Kandinsky 2.1 по запросу «современный художник за работой»

Разработчики сообщили, что алгоритму Kandinsky 2.1 потребовалось всего четыре дня, чтобы достичь отметки в 1 млн уникальных пользователей. Любопытно, что это на один день быстрее результата чат-бота ChatGPT компании Open AI. Согласно имеющимся данным, с момента запуска алгоритма было сгенерировано свыше 10 млн изображений, а число уникальных пользователей достигло 2 млн человек. Также отмечается, что на прошлой неделе алгоритм Kandinsky 2.1 попал в топ-5 трендов мировых репозиториев по версии сервиса GitHub.

Напомним, алгоритм Kandinsky 2.1 может генерировать изображения по их текстовому описанию на естественном языке. Модель поддерживает обработку запросов на 101 языке и готова открыть для пользователей новые творческие возможности, включая смешивание нескольких рисунков, дорисовку изображений, создание картин в режиме бесконечного полотна и др. Разработкой и обучением алгоритма занимались специалисты Sber AI совместно с учёными из Института искусственного интеллекта AIRI на объединённом дата-сете Sber AI и компании SberDevices. Kandinsky 2.1 содержит 3,3 млрд параметров вместо 2 млрд параметров в предыдущей версии алгоритма.

← В прошлое В будущее →

✴ Входит в перечень общественных объединений и религиозных организаций, в отношении которых судом принято вступившее в законную силу решение о ликвидации или запрете деятельности по основаниям, предусмотренным Федеральным законом от 25.07.2002 № 114-ФЗ «О противодействии экстремистской деятельности»;

выдано Федеральной Службой по надзору за соблюдением законодательства в сфере массовых коммуникаций и охране культурного наследия

При цитировании документа ссылка на сайт с указанием автора обязательна. Полное заимствование документа является нарушением
российского и международного законодательства и возможно только с согласия редакции 3DNews.