Российские ученые первыми в мире обучили ИИ самостоятельно адаптироваться к новым действиям
В прошлом ИИ-системы выполняли определенный набор задач, а при появлении новых их нужно было переобучать. На это уходили дополнительные финансовые и вычислительные ресурсы. Открытие лаборатории исследований искусственного интеллекта T-Bank AI Research и Института AIRI меняет ситуацию. Ученые первыми в мире создали модель в области контекстного обучения (In-Context Learning), которая на нескольких примерах сама может учиться новым действиям.
Модель, названная Headless-AD, способна выполнять в пять раз больше действий, чем в нее заложено при начальном обучении. Такого рода ИИ-системы, умеющие адаптироваться к изменениям среды и новым задачам без вмешательства людей, будут полезны во многих областях — от бытовых до связанных с космической отраслью.
В частности, подобные системы могут найти применение в домашних роботах-помощниках. Предварительно их можно будет обучать стандартному набору действий в доме. В дальнейшем, за счет заложенных в Headless-AD возможностей к самообучению, домашние роботы смогут подстраиваться под персональные нужды домохозяйств.
Еще один возможный сценарий — внедрение Headless-AD в беспилотных автомобилях. ИИ-модель позволит им адаптироваться к замене деталей на новые, причем даже с другим принципом работы. Пример — установка более мощного двигателя или нового типа шин.
Исследователи провели серию экспериментов, в которых сравнили Headless-AD с ближайшими аналогами. Одна из протестированных задач — составление рекомендаций к товарам. Другие модели требуют переобучения для новых групп товаров, а при увеличении их количества теряют в качестве. Headless-AD показала преимущество, поскольку может рекомендовать в пять раз больше подходящих товаров по сравнению со стартовым набором, которому ее обучили.
В других экспериментах Headless-AD тоже доказала способность выполнять любые комбинации и число действий без снижения качества и дополнительного обучения. Модель и результаты испытаний подробно описали в статье In-Context Reinforcement Learning for Variable Action Spaces. Исходный код и дополнительные материалы доступны на сайте GitHub.
Российскую разработку представили на международной конференции по машинному обучению ICML (International Conference on Machine Learning), одной из самых престижных и крупных в этой сфере. В 2024 году мероприятие проходит в Австрии с 21 по 27 июля.
О T-Bank AI Research
Лаборатория T-Bank Al Research, входящая в состав Центра искусственного интеллекта Т-Банка, исследует наиболее перспективные направления в области искусственного интеллекта. Среди них — обработка естественного языка (NLP), компьютерное зрение (CV) и рекомендательные системы (RecSys).
Статьи исследователей участвуют в авторитетных научных конференциях, таких как NeurIPS, ICML, ACL, CVPR и других. Выдержки из них в своих публикациях цитируют ученые из университетов Беркли и Стэнфорда, а также участники исследовательского проекта Google DeepMind.
Команда помогает и молодым талантам, курируя исследовательские лаборатории T-Bank Lab в МФТИ и Omut AI в Центральном университете.
Британские физики впервые визуализировали процесс, при котором две отрицательно заряженные молекулы ДНК сближаются и пристыковываются друг к другу точно в местах с одинаковым генетическим кодом вопреки ожидаемому отталкиванию. Прямое наблюдение этого механизма подтвердило 20-летнюю гипотезу и раскрыло фундаментальные процессы восстановления генома, деления клеток и развития онкологических заболеваний.
Японские ученые выяснили, что даже короткий вдох аромата свежесваренного кофе способен быстро улучшить эмоциональное состояние и уменьшить уровень стресса. У молодых участников эксперимента всего за пять минут вдыхания кофейного аромата снизились показатели тревожности, усталости и подавленности. При этом частота сердечных сокращений практически не изменилась.
Падение астероида примерно 66 миллионов лет назад запустило цепь событий, которые привели к вымиранию нептичьих динозавров. Однако некоторые группы пресмыкающихся пережили эту катастрофу и начали быстро восстанавливаться. Всего через несколько сотен тысяч лет после случившегося в реках Северной Америки уже охотился двухметровый хищник с необычными зубами, способными дробить твердую пищу. Его остатки помогли ученым понять, как аллигаторы развивались практически сразу после вымирания.
Нейросеть OpenAI добилась серьезного прорыва в математике, решив одну из семи «задач тысячелетия». Получат ли США, чьи нейросети опираются на гораздо более мощное «железо», чем у Китая, монополию на конвейер научных открытий? Даст ли это возможности сравнимые с их атомной монополией 80 лет назад?
Современная космология до недавнего времени опиралась на так называемый космологический принцип, по которому у Вселенной нет какого-то выделенного направления. И наблюдатель в любой ее точке должен видеть однородную в этом смысле картину. Астроном из Северокавказской астрофизической обсерватории показал, что это не так даже для очень древней Вселенной.
Превратив почти 30 лет наблюдений за сверхмассивной черной дырой в видео, астрономы выяснили, что яркие участки в джете движутся совсем не так, как считалось раньше.
Нейросеть OpenAI добилась серьезного прорыва в математике, решив одну из семи «задач тысячелетия». Получат ли США, чьи нейросети опираются на гораздо более мощное «железо», чем у Китая, монополию на конвейер научных открытий? Даст ли это возможности сравнимые с их атомной монополией 80 лет назад?
Сопротивление жителей Европы самой идее употребления насекомых в пищу может иметь эволюционные корни, уходящие вглубь тысячелетий, пришли к выводу авторы нового исследования. Оказалось, предки современных европейцев ели насекомых лишь эпизодически. Кроме того, из-за генетических мутаций они плохо переваривали их экзоскелеты.
После сокращения длины очередей и роста доступности бензина в первую неделю августа ситуация снова ухудшилась. Если с 20 июня по начало августа кризис носил в основном психологический характер, то сейчас ситуация принципиально иная: августовские атаки на НПЗ показали, что меры по усилению их противовоздушной обороны не были достаточно полными. Значит, прогноз автора Naked Science от 19 июля о том, что острая фаза кризиса закончится до конца лета, был частично неверным.
Вы попытались написать запрещенную фразу или вас забанили за частые нарушения.
Понятно
Что-то в вашем комментарии показалось подозрительным, поэтому перед публикацией он пройдет модерацию.
Понятно
Из-за нарушений правил сайта на ваш аккаунт были наложены ограничения. Если это ошибка, напишите нам.
Понятно
Наши фильтры обнаружили в ваших действиях признаки накрутки. Отдохните немного и вернитесь к нам позже.
Понятно
Мы скоро изучим заявку и свяжемся с Вами по указанной почте в случае положительного исхода. Спасибо за интерес к проекту.
Понятно
Последние комментарии