• Добавить в закладки
  • Facebook
  • Twitter
  • Telegram
  • VK
  • Печать
  • Email
  • Скопировать ссылку
02.11.2021, 21:35
Мария Азарова
16
8,9 тыс

«Сбер» представил нейросеть ruDALL-E. Она создает красивые картинки по описанию на русском языке

❋ 3.7

Проект по обучению ruDALL-E — самый большой нейросетевой вычислительный проект в России и СНГ, который можно считать «настоящим прорывом для русскоязычной индустрии».

Сгенерированные картинки
Сгенерированные картинки / © Сбер / Автор: Ирина Мельникова

«Сбер» представил первую нейросеть, которая генерирует неограниченное число изображений на основе заданного описания на русском языке. Разработку назвали ruDALL-E, рассказывается на посвященном ей сайте и в пресс-релизе. ruDALL-E может пригодиться копирайтерам, а также специалистам и обычным людям при поисках нужного варианта дизайна интерьера помещений, для создания стоковых картинок, векторных иллюстраций, а также рекламных материалов.

«Помимо вклада в прогресс в области ИИ, генерация изображений закрывает две важных потребности современного бизнеса — возможность получить уникальную картинку под собственное описание, а также в любой момент создавать необходимое количество licence-free-иллюстраций. При этом создание «мультимодальных» нейронных сетей, которые обучаются сразу на нескольких видах данных, даже сейчас, в эпоху big data и огромных возможностей поиска, будет очень востребованным, поскольку решает задачи на принципиально ином уровне. Технология пока совсем новая, первые шаги в этом направлении были сделаны только в 2020 году, а еще в 2018-2019 годах даже постановку такого рода задачи нельзя было себе представить. ruDALL-E можно считать настоящим прорывом для русскоязычной индустрии», — отметил Давид Рафаловский, исполнительный вице-президент Сбербанка и руководитель блока «Технологии».

Всего есть два варианта модели. Первый — ruDALL-E Malevich (XL) — содержит 1,3 миллиарда параметров и «по короткому текстовому описанию <…> генерирует яркие и красочные изображения на самые разные темы и сюжеты, <…> понимает обширный набор понятий и генерирует совершенно новые изображения и объекты, которых не существовало в реальном мире». Этой версией нейросети можно пользоваться бесплатно: нужно лишь загрузить ее с сервиса Github.

Второй вариант — ruDALL-E Kandinsky (XXL) — имеет ту же архитектуру, что и ruDALL-E Malevich, но содержит уже 12 миллиардов параметров. В ближайшее время обе модели станут доступны на платформе ML Space, в хабе DataHub от SberCloud — облачной платформы «Сбера», разработчик которой, ООО «Облачные технологии», в 2019 году представил самый мощный в России суперкомпьютер Christofari.

Примеры сгенерированных ruDALL-E Kandinsky картинок / © Сбер

Итак, ruDALL-E создает изображения по текстовому описанию (кстати, обучается она и на картинках) в три этапа. Одна нейросеть берет текст на вход и генерирует необходимое число картинок, после чего другая нейросеть определяет, какие из них самые удачные и больше всего соответствуют заданным пользователем характеристикам. Затем третья нейросеть увеличивает картинки в размере. Что особенно важно: качество при этом никак не страдает.

Ранее в этом году Sber AI — подразделение «Сбера», ответственное за развитие и внедрение технологий ИИ — представило архитектуру модели DALL-E для английского языка. Но в открытом доступе она полностью не появилась. На основе их разработки SberDevices и Sber AI вместе с коллегами из SberCloud воспроизвели код и запустили обучение нейросети на ML Space на базе суперкомпьютера Christofari. На создание русского варианта нейросети ушло 23 тысячи GPU-часов (Graphics Processing Unit) и массив данных из 120 миллионов пар текст — изображение.

Нашли опечатку? Выделите фрагмент и нажмите Ctrl + Enter.
Подписывайтесь на нас в Telegram, Яндекс.Новостях и VK
Предстоящие мероприятия
4 июля, 09:30
Любовь С.

Анализ более 150 тысяч древних звезд Млечного Пути показал, что возраст космоса, судя по всему, близок к 13,8 миллиарда лет. Авторы нового исследования заключили, что сценарии, в которых Вселенную приходится делать заметно «моложе» ради решения хаббловского кризиса, плохо согласуются с наблюдениями. Это важно, поскольку возраст старейших светил — один из немногих независимых способов проверить космологические модели не по данным ранней Вселенной, а по объектам нашей собственной Галактики.

5 июля, 11:05
Марк Чернов

Новая находка доказывает, что эволюция изобрела как минимум два независимых способа бороться с вирусами. Это открытие кардинально меняет представления о развитии иммунитета и расширяет горизонты для поиска новых лекарств.

4 июля, 17:28
Evgenia Vavilova

Мы много знаем о том, как цивилизации до нас строили дома и дороги, но с объектами материальной культуры дела обстоят сложнее. Ремесленные техники часто хранились в строгом секрете и могли быть случайно утрачены при неудачном стечении обстоятельств. Так случилось с ювелирной техникой цзинь чжэ сы.

4 июля, 09:30
Любовь С.

Анализ более 150 тысяч древних звезд Млечного Пути показал, что возраст космоса, судя по всему, близок к 13,8 миллиарда лет. Авторы нового исследования заключили, что сценарии, в которых Вселенную приходится делать заметно «моложе» ради решения хаббловского кризиса, плохо согласуются с наблюдениями. Это важно, поскольку возраст старейших светил — один из немногих независимых способов проверить космологические модели не по данным ранней Вселенной, а по объектам нашей собственной Галактики.

5 июля, 11:05
Марк Чернов

Новая находка доказывает, что эволюция изобрела как минимум два независимых способа бороться с вирусами. Это открытие кардинально меняет представления о развитии иммунитета и расширяет горизонты для поиска новых лекарств.

1 июля, 08:40
Марк Чернов

В вакууме космоса два металлических предмета, прижатые друг к другу, могут спонтанно свариться без какого-либо нагрева. Из-за отсутствия кислорода на поверхностях деталей разрушается защитный слой, в результате чего свободные электроны начинают мгновенно перемещаться между ними и соединяют два элемента в один монолит.

10 июня, 11:51
Александр Березин

Хотя длительность помех не превышала десяти секунд, это первый известный случай такого рода. Обычно спутникам не хватает мощности для создания радиосигналов той силы, что нужна для подобных помех.

25 июня, 16:20
Любовь С.

Вселенная может оказаться «замкнутой» глобальной структурой, где свет от далеких галактик способен возвращаться к наблюдателю с разных направлений. Именно такой сценарий не удалось исключить авторам нового масштабного обзора. Проверить его предсказания астрономы смогут уже в ближайшие годы.

25 июня, 15:09
Марк Чернов

Ученые впервые на молекулярном уровне доказали, что обычная вода одновременно состоит из двух разных жидких состояний — более плотного и менее плотного, которые непрерывно сменяют друг друга. Раз молекулярная «двойственность» действительно существует, это подтверждает спорную 30-летнюю гипотезу. Новое открытие поможет, наконец, объяснить десятки «странных» физических аномалий воды, включая ее расширение при замерзании и парадоксальное изменение вязкости под давлением.

[miniorange_social_login]

Комментарии

16 Комментариев
-
0
+
Простая нейросеть.
Eek TheCat
06.11.2021
-
0
+
«Девушка в костюме пикачу»
Max Mad
03.11.2021
-
0
+
Подозреваю этот прорыв построен на openai, тупо ру бд добавили да свои логотипы воткнули))
Хм, а если нужна блеклая картинка, или тусклая картинка, или растровая картинка, или пиксельная картинка...Логичнее было бы сделать характер картинки опциональным. Если эдак на каждый тип картинки делать свою особенную нейросеть, то... сберу придется повышать комиссионные и проценты за кредит ,чтобы перекрестно финансировать эту муру.
    Смотрю у вас созрела еще одна теория заговора.
    +
      ещё комментарии
      Ну а за чей счет сбер занимается этой социальной нагрузкой? За счет основной финансовой деят-ти, разумеется. За счет заемщиков и клиентов. Которых не спросили, согласны ли они финансировать потемкинские деревни. Сбер обязали выдавать что-нибудь эдакое модное, вот он и делает.
Asmite Qielee
02.11.2021
-
0
+
Скорее находит в гугл поиск, чем создаёт
    А вот посмотрим. Задал запрос "жопа с ручкой" обещала выдать результат через 25 мин. Уже то что можно попробовать вселяет надежду что не фейк. В инете много описаний прорывных нейросетей с красивыми картинками но гораздо меньше тех где пользователь может сам проверить их работу.
    Вот это я понимаю это вам не "красивая собачка" Видно что нейросеть пыхтела старалась сама как могла. Потому что готовых приколов на эту тему полно а тут эксклюзив.