Уведомления
Авторизуйтесь или зарегистрируйтесь, чтобы оценивать материалы, создавать записи и писать комментарии.
Авторизуясь, вы соглашаетесь с правилами пользования сайтом и даете согласие на обработку персональных данных.
Ученые из Tinkoff Research создали алгоритм, повышающий скорость обучения ИИ в 20 раз
Специалисты лаборатории исследований искусственного интеллекта Tinkoff Research — одна из немногих исследовательских групп, которая проводит научные исследования внутри компании, а не на базе некоммерческой организации — сообщили об открытии нового алгоритма, обучающего ИИ в 20 раз быстрее. Результаты представили на 40-й Международной конференции по машинному обучению (ICML), прошедшей в конце июля на Гавайских островах.
Новый метод назвали SAC-RND — Soft Actor Critic (мягкий актор-критик), RND — Random Network Distillation (случайные нейронные сети). Как показали испытания на робототехнических симуляторах, SAC-RND от Tinkoff Research в 20 раз быстрее и на 10 процентов качественнее достигает результатов при меньшем количестве потребляемых ресурсов и времени.
В методе RND задействованы случайная и основная нейросети, при этом вторая пытается предсказать поведение первой. Важна глубина нейросети, то есть количество слоев, из которых она состоит. У основной их не должно быть меньше, чем у случайной, в противном случае она не сможет смоделировать ее поведение. Это повлечет нестабильность либо станет причиной невозможности обучения.
Ученые из Tinkoff Research выяснили, что у авторов предыдущих исследований, посвященных теме использования случайных нейросетей в обучении с подкреплением (Reinforcement learning, RL), размер случайной сети составлял четыре слоя, в то время как у основной их было два. Таким образом удалось выявить недостатки в более ранних экспериментах и выводах, из-за которых считалось, что метод RND не способен классифицировать данные — отличать действия в датасете от тех, что там не было. Специалисты Tinkoff Research исправили глубины сетей, превратив их в эквивалентные, и обнаружили, что в таком случае метод может различать данные.
Затем ученые взялись за оптимизацию метода: в итоге, за счет механизма слияния, в основе которого — модуляция сигналов и их линейное отображение, — роботы научились приходить к эффективным решениям. В предыдущих исследованиях на тему RND сигналы дополнительно не обрабатывали.
Благодаря SAC-RND появится возможность повысить уровень безопасности беспилотных автомобилей, облегчить логистические цепочки, сделать быстрее доставку и работу на складах. Помимо этого, с помощью нового метода можно будет оптимизировать процессы горения на энергетических объектах и сократить выбросы вредных веществ.
«Обучение искусственного интеллекта — процесс, требующий больших ресурсов: прежде всего вычислительных мощностей, финансовых затрат и времени. Его оптимизация позволит ускорить развитие всех областей, в которых используются ИИ-агенты, например робототехники».
Пресс-служба «Тинькофф»
Более того, разработка ученых из Tinkoff Research позволит не только сделать лучше работу узкоспециализированных роботов, ускорить исследования, в том числе в области обучения с подкреплением, но и приблизит создание универсального робота, который будет справляться с различными задачами в одиночку.
Многие говорят, что занимаются спортом для поддержания здоровья. Однако ученые с помощью инструментов искусственного интеллекта и машинного обучения установили, что на самом деле большинство людей к тренировкам подталкивает несколько другая причина.
В созвездии Стрельца наблюдают молодую, еще формирующуюся систему с обширным протопланетным диском, в котором «поведение» вещества выдает присутствие нескольких новорожденных планет. Как выяснилось, активное движение этого вещества дает новым мирам шанс когда-нибудь стать обитаемыми. Вдобавок небесные тела с полезными для жизни веществами все время разлетаются оттуда прочь и отправляются в межзвездное путешествие.
Неандертальцы процветали в Европе две сотни тысяч лет и вымерли примерно 40 тысяч лет назад. Одни винят в этом Homo sapiens, которые как раз в то время появились в регионе. Другие видят причины в изменении климата. Однако неандертальцы пережили эпохи мощных оледенений. Их стоянки находят в разных климатических зонах — от лугов умеренных широт до тундры. Значит, они могли приспосабливаться к смене окружающей среды. В новой работе ученые из Франции и Великобритании протестировали климатическую гипотезу вымирания этой ветви людей.
В двойственных, или обратимых, изображениях зритель может увидеть разные объекты в зависимости от того, на каких деталях концентрируется его внимание. Среди известных примеров таких рисунков — иллюзия «кролик-утка», сочетающая двух животных, и обратимая ваза (или ваза Рубина), которая может казаться двумя силуэтами лиц, если сосредоточиться на фоне. В соцсетях и популярных СМИ часто публикуют подобные картинки, утверждая, что по тому, какое изображение человек видит в первую очередь, можно судить о его личностных чертах и особенностях мышления. Двое психологов из Великобритании недавно проверили, так ли это на самом деле.
В наши дни на кельтских языках говорят лишь в прибрежных областях северо-запада Европы. А две-три тысячи лет назад они охватывали большую часть европейского населения. Традиционно их связывали с археологической культурой колоколовидных кубков, есть работы об их появлении в Британии, на Иберийском полуострове, юго-западе Германии. А вот о прародине мнения разошлись. В новом исследовании ученые провели обширный генетический анализ древней ДНК и протестировали гипотезы происхождения этой группы индоевропейских языков.
Немецкие биологи купили кусочек янтаря, добытый из карьера в российском городе Янтарный, и обнаружили в нем застывшую бабочку. Вернее, яйцо, из которого больше 30 миллионов лет назад должна была появиться бабочка. Но зародыш завяз в древесной смоле и через несколько эпох попал в руки исследователей. По характерному строению яйца ученые отнесли находку к новому роду и виду.
Пролетевший через Солнечную систему в 2017 году астероид Оумуамуа произвел неизгладимое впечатление в том числе своей беспрецедентно вытянутой формой. Астрономы попытались рассчитать, как он мог стать таким и почему в Солнечной системе мы не наблюдаем ничего подобного.
В двойственных, или обратимых, изображениях зритель может увидеть разные объекты в зависимости от того, на каких деталях концентрируется его внимание. Среди известных примеров таких рисунков — иллюзия «кролик-утка», сочетающая двух животных, и обратимая ваза (или ваза Рубина), которая может казаться двумя силуэтами лиц, если сосредоточиться на фоне. В соцсетях и популярных СМИ часто публикуют подобные картинки, утверждая, что по тому, какое изображение человек видит в первую очередь, можно судить о его личностных чертах и особенностях мышления. Двое психологов из Великобритании недавно проверили, так ли это на самом деле.
Исследователи из Южной Кореи и Канады нашли новое объяснение «парадоксу счастья». Они обнаружили, что попытки стать счастливее приводят к противоположному результату, потому что истощают систему самоконтроля.
Вы попытались написать запрещенную фразу или вас забанили за частые нарушения.
ПонятноИз-за нарушений правил сайта на ваш аккаунт были наложены ограничения. Если это ошибка, напишите нам.
ПонятноНаши фильтры обнаружили в ваших действиях признаки накрутки. Отдохните немного и вернитесь к нам позже.
ПонятноМы скоро изучим заявку и свяжемся с Вами по указанной почте в случае положительного исхода. Спасибо за интерес к проекту.
ПонятноМы скоро прочитаем его и свяжемся с Вами по указанной почте. Спасибо за интерес к проекту.
Понятно
Комментарии