Этот пост добавлен читателем Naked Science в раздел «Сообщество». Узнайте как это сделать по ссылке.

427

ИИ научился превращать текст в видео

Представлена новая система под названием Make-A-Video, которую разработали инженеры Meta* (признана экстремистской организацией на территории России). Как и следует из названия, пользователь может ввести текстовое описание того, что он хочет увидеть, а система с помощью искусственного интеллекта (ИИ) генерирует короткий ролик, соответствующий тексту. Видео пока что не слишком качественные, с размытыми объектами и искаженной анимацией, но все же система представляет значительный шаг вперед в области создания контента с помощью ИИ. 

Пример видео, сгенерированный новой моделью преобразования текста на основе искусственного интеллекта Make-A-Video. Текст для создания ролика гласил: «плюшевый мишка рисует свой портрет» / ©Meta*

Make-A-Video сейчас генерирует 16 кадровые ролики с разрешением 64 на 64 пикселя, которые затем увеличиваются в размере с помощью отдельной модели ИИ до 768 на 768.

Создатели системы отмечают, что Make-A-Video обучается на парах изображений и подписей, а также на немаркированных видеоматериалах. Учебный контент получается из двух наборов данных (WebVid-10M и HD-VILA-100M), которые вместе содержат миллионы видеороликов, охватывающих сотни тысяч часов отснятого материала. Сюда входят стоковые видеоматериалы, размещенные на таких сайтах, как Shutterstock, и извлеченные из других сайтов в Сети.  

Сейчас не известно, как и/или когда Make-A-Video станет общедоступным средством создания контента.  

Нашли опечатку? Выделите фрагмент и нажмите Ctrl (Cmd) + Enter.
Подписывайтесь на нас в Telegram, Дзен и в последнюю очередь на VK

Комментарии

Написать комментарий
Предстоящие мероприятия
[miniorange_social_login]