20.12.2024, 14:52

ФизТех

Новые алгоритмы ускоряют машинное обучение в децентрализованных сетях

❋ 4.4

Международная команда ученых совершила прорыв в области распределенного машинного обучения, разработав новые алгоритмы, значительно повышающие эффективность обучения моделей в федеративных сетях. Исследование, проведенное группой, куда вошли специалисты МФТИ, представляет собой значительный шаг вперед в решении проблемы высокой вычислительной сложности обучения больших моделей в распределенных системах.

ФизТех

# алгоритмы

# вычисления

# децентрализованные сети

# машинное обучение

Сравнение новых четырех предложенных методов (Q-NASTYA, DIANA-NASTYA, Q-RR, DIANA-RR) и существующих (FedCOM, FedPAQ) с настроенными размерами шагов и компрессором Rand-k. / © NeurIPS 2024

Результаты опубликованы в материалах конференции NeurIPS 2024. Современное машинное обучение часто опирается на обучение моделей на огромных объемах данных, что требует распределенных вычислений. Федеративное обучение (Federated Learning, FL) — это подход, позволяющий обучать модели на децентрализованных данных, хранящихся на множестве устройств (смартфоны, медицинские приборы и так далее), без прямого обмена этими данными.

Ключевая проблема федеративного обучения заключается в высокой коммуникационной сложности. А именно передача данных и вычисление градиентов на основе них (векторов, характеризующих направление изменения параметров модели) становится проблемой, которая замедляет весь процесс обучения. Коммуникационная сложность заключается в огромном количестве передач данных по сети, необходимых для достижения заданной точности решения.

Обычно для решения этой проблемы используют стохастический градиентный спуск. Он основан на том, чтобы использовать неполную информацию для вычисления градиента, выбирая используемые данные для этого случайным образом. такие методы делятся на методы с возвращением и без возвращения. При выборе с возвращением один и тот же набор данных может быть выбран несколько раз, а при выборе без возвращения каждый набор данных выбирается только один раз.

В свежей статье, представленной на конференции NeurIPS 2024, авторы предлагают новые подходы. Они разработали четыре новых алгоритма, сочетающие сжатие градиентов с методом случайной перестановки и локальными вычислениями.

Сравнение алгоритмов Q-RR, QSGD, DIANA и DIANA-RR в задаче обучения глубокой нейронной сети / © NeurIPS 2024

Первый новый алгоритм они назвали Q-RR (Quantized Random Reshuffling). Это самый наивный подход, сочетающий сжатие градиентов и метод перестановки. К сожалению, теоретический анализ показал, что этот метод не демонстрирует преимуществ перед традиционными методами сжатия градиентов.

Второй предложенный учеными метод, названный ими DIANA-RR, является модификацией первого. Они улучшили предыдущий подход, добавив снижение дополнительной дисперсии, которая возникла из-за сжатия градиентов. В результате им удалось получить алгоритм, который имеет лучшую скорость сходимости, чем существующие аналоги, основанные на выборке с возвращением.

Для лучшей адаптации к задачам федеративного обучения ученые расширили алгоритмы Q-RR и DIANA-RR, добавив локальные вычислительные шаги. Так они получили ещё два новых метода, которые назвали Q-NASTYA и DIANA-NASTYA. Эти методы используют разные размеры шагов для локальных и глобальных обновлений. Однако при этом и DIANA-NASTYA, и DIANA-RR предназначены для уменьшения дополнительной дисперсии, вносимой сжатием градиентов.

Авторы исследования провели теоретический анализ и три численных эксперимента, которые подтвердили эффективность предложенных алгоритмов. Алгоритмы DIANA-RR и DIANA-NASTYA значительно превосходят по скорости сходимости существующие методы, особенно при высокой степени сжатия градиентов и в условиях, когда требуется высокая точность.

Для моделирования в первых двух экспериментах авторы использовали решение бинарной проблемы классификации (проверке принадлежности объектов к одному из двух классов) методом логистической регрессии с регуляризацией. В первых двух экспериментах они сравнивали между собой локальные и нелокальные методы.

Оказалось, что результаты, наблюдаемые в численных экспериментах, идеально соответствовали выведенной теории.

В третьем эксперименте авторы использовали нелокальные методы для распределенного машинного обучения глубокой нейронной сети, и в нем новые методы тоже показали свое преимущество над традиционными подходами.

«Многие существующие работы в области федеративного обучения рассматривают методы стохастического градиентного спуска с возвращением. Однако недавно удалось показать как теоретически, так и практически, что методы, основанные на выборке без возвращения, например, метод случайной перестановки, работают лучше», — рассказал Абдурахмон Садиев, научный сотрудник лаборатории численных методов прикладной структурной оптимизации ФПМИ МФТИ.

Разработанные алгоритмы представляют собой важный вклад в область федеративного обучения, позволяя существенно ускорить процесс обучения больших моделей при ограниченных коммуникационных ресурсах. Это открывает новые возможности для применения машинного обучения в различных областях, где важна защита конфиденциальности данных. Дальнейшие исследования будут направлены на оптимизацию алгоритмов и их адаптацию к более сложным задачам федеративного обучения.

Нашли опечатку? Выделите фрагмент и нажмите Ctrl + Enter.

Московский физико-технический институт (национальный исследовательский университет), известен также как Физтех — ведущий российский вуз по подготовке специалистов в области теоретической, экспериментальной и прикладной физики, математики, информатики, химии, биологии и смежных дисциплин. Расположен в городе Долгопрудном Московской области, отдельные корпуса и факультеты находятся в Жуковском и в Москве.

ФизТех

# алгоритмы

# вычисления

# децентрализованные сети

# машинное обучение

Подписывайтесь на нас в Telegram, Яндекс.Новостях и VK

Дзен

Предстоящие мероприятия

Органическая химия азота для медицины и освоения космоса

Космонавтика и авиация

Москва

Лекция

13 Июл

Бесплатно

Насколько огромна Вселенная?

Космонавтика и авиация

Москва

Лекция

13 Июл

Бесплатно

Культура и быт советской эпохи: 1970–1980-е годы — Застой и перестройка

ВДНХ

Москва

Лекция

13 Июл

Бесплатно

Что было до трилобитов: как появились членистоногие

Библиотека им. Маяковского

Санкт-Петербург

Лекция

13 Июл

1200 ₽

Как молекула стала живой

Medio Modo

Санкт-Петербург

Лекция

14 Июл

Бесплатно

Проблематики: кто ты, древний незнакомец?

Центр «Архэ»

Онлайн

Лекция

15 Июл

Бесплатно

Мы зря выделяли суффиксы

Библиотека им. Н. А. Некрасова

Москва

Экскурсия

15 Июл

500 ₽

«Союз» — «Аполлон» — рукопожатие в космосе

Политехнический музей

Москва

Лекция

15 Июл

Бесплатно

Хрустальные ночи Арктики: судьбы ледоколов и свет звезд

Библиотека Планетарий 1

Санкт-Петербург

Популярное

За сутки

За неделю

За месяц

12 июля, 22:10

Редакция Naked Science

Научно-фантастические сериалы лета, на которые стоит обратить внимание

Лето 2025 обещает насыщенную линейку научно-фантастических сериалов на ведущих стриминговых платформах. От адаптаций культовых романов до масштабных космических одиссей — мы отобрали проекты, на которые стоит обратить внимание.

Sci-Fi

# «Звездный путь»

# научная фантастика

# сериалы

11 июля, 17:47

Денис Яковлев

Ученые определили оптимальную длительность физической активности, которая продлевает жизнь на треть

Международная команда ученых оценила связь между длительностью физической активности, ее интенсивностью, риском смерти от всех причин и вероятностью развития сердечно-сосудистых и онкологических заболеваний.

Медицина

# ЗОЖ

# онкологические заболевания

# сердечно-сосудистые болезни

# смертность

# спорт

11 июля, 12:37

Игорь Байдов

Астрофизики обнаружили новый тип плазменных волн вблизи Юпитера

Наблюдения, проведенные космическим аппаратом NASA «Юнона», показали, что магнитное поле Юпитера и его мощная магнитосфера, заполненная ионизированным газом, могут порождать вблизи полюсов газового гиганта новый тип плазменных волн. Ничего подобного ранее ученые не фиксировали.

Астрономия

# «Юнона»

# газовые гиганты

# плазма

# плазменные волны

# Полярное сияние

# Юпитер

8 июля, 11:16

РНФ

Российские инженеры повысили надежность сигналов Wi-Fi и навигации с помощью нового открытия

Ученые предложили математический инструмент, позволяющий точно рассчитать условия стабильной работы систем фазовой автоподстройки частоты, используемых в устройствах связи и навигации. Такие системы синхронизируют параметры собственных сигналов устройства, например телефона, с поступающими на него сигналами, например, от Wi-Fi-роутера. Предложенный метод расчетов позволяет избежать неточностей, которые допускали ранее используемые подходы, и предлагает инженерам простые формулы, удобные для применения в реальных проектах. Это позволит предотвратить ошибки в работе приборов спутниковой навигации и беспроводной связи.

РНФ

# GPS

# Wi-Fi

# навигация

# программа

12 июля, 22:10

Редакция Naked Science

Научно-фантастические сериалы лета, на которые стоит обратить внимание

Sci-Fi

# «Звездный путь»

# научная фантастика

# сериалы

8 июля, 13:00

ПНИПУ

Тепло, ярко, экономно: какая лампочка спасет ваш кошелек и планету

Лампочки, фонари и неоновые вывески окружают нас повсюду. Они добавляют красок городскому пространству, создают домашний уют, обеспечивают безопасность на дорогах, позволяя нам отчетливо видеть окружающий мир в любое время суток. Ученые Пермского Политеха рассказали о разнице между тепловыми, диодными, газоразрядными лампочками и их применении в быту.

ПНИПУ

# лампа

# лампа накаливания

# свет

# светодиоды

# Томас Эдисон

17 июня, 16:49

Адель Романова

Давно отключенный спутник внезапно прислал «громкий» радиосигнал

Радиотелескопы уловили очень короткий сигнал, и по его характеристикам стало ясно, что он не может быть естественного происхождения. Астрономы пришли к выводу, что источник находился в околоземном пространстве — там, где уже более полувека летает «мертвый» аппарат NASA.

Астрономия

# космический мусор

# космос

# радиосигналы

# спутники

25 июня, 15:19

ФизТех

Российские ученые впервые точно определили источники шума сверхзвукового самолета с помощью суперкомпьютера

Группа российских ученых из Института прикладной математики имени М. В. Келдыша РАН и МФТИ провела детальное численное исследование источников шума, генерируемых крылом прототипа сверхзвукового бизнес-джета в режиме посадки. Эта работа, сочетающая передовые методы вычислительной гидродинамики и аэроакустики, впервые позволила с высокой точностью локализовать и охарактеризовать основные зоны шумообразования вблизи полноразмерной геометрии крыла модели прототипа сверхзвукового пассажирского самолета в посадочной конфигурации.

ФизТех

# «Суперджет»

# самолет

# сверхзвуковой

# суперкомпьютеры

# Шум

2 июля, 11:17

Юлия Тарасова

Коров покормили отходами конопли и проверили их молоко на психоактивность

Результаты эксперимента в США в будущем могут позволить добиться разрешения на использование отработанной конопли в качестве кормовой добавки в животноводстве.

Биология

# животноводство

# конопля

# корм

# коровы

# молоко

# ТГК

# тетрагидроканнабинол

[miniorange_social_login]

Новые алгоритмы ускоряют машинное обучение в децентрализованных сетях

По теме

Предложен новый метод решения вариационных неравенств в условиях, когда производные нельзя вычислить точно

Алгоритмы машинного обучения помогут точнее оценивать будущее российских компаний

Разработан эффективный «оптимистичный» алгоритм для обучения с подкреплением

Популярное

Научно-фантастические сериалы лета, на которые стоит обратить внимание

Ученые определили оптимальную длительность физической активности, которая продлевает жизнь на треть

Астрофизики обнаружили новый тип плазменных волн вблизи Юпитера

Российские инженеры повысили надежность сигналов Wi-Fi и навигации с помощью нового открытия

Научно-фантастические сериалы лета, на которые стоит обратить внимание

Тепло, ярко, экономно: какая лампочка спасет ваш кошелек и планету

Давно отключенный спутник внезапно прислал «громкий» радиосигнал

Российские ученые впервые точно определили источники шума сверхзвукового самолета с помощью суперкомпьютера

Коров покормили отходами конопли и проверили их молоко на психоактивность

Комментарии

Хотите
вести колонку
в нашем
издании?

Колумнисты 64

ПНИПУ

ФизТех

Сколтех

НИУ ВШЭ

ТюмГУ

РНФ

ЮФУ

МГППУ

НИТУ МИСИС

КНЦ РАН

Разрезать на расстоянии: как работают современные лазерные технологии

30 научных терминов, которые должен знать каждый

Животные-рекордсмены

Пакистан и Индия на пороге новой войны: что не поделили две ядерные державы?

Безопасность превыше всего: как NASA планирует доставить первых людей на Марс?

Афродиты и троглодиты: кто такие палеолитические Венеры

Мобильный атом: от Чукотки до тропических островов?

Космический субботник: проекты по защите Земли от орбитального мусора

Новые алгоритмы ускоряют машинное обучение в децентрализованных сетях

По теме

Предложен новый метод решения вариационных неравенств в условиях, когда производные нельзя вычислить точно

Алгоритмы машинного обучения помогут точнее оценивать будущее российских компаний

Разработан эффективный «оптимистичный» алгоритм для обучения с подкреплением

Популярное

Комментарии

Хотите вести колонку в нашем издании?

Колумнисты 64

ПНИПУ

ФизТех

Сколтех

НИУ ВШЭ

ТюмГУ

РНФ

ЮФУ

МГППУ

НИТУ МИСИС

КНЦ РАН

Хотите
вести колонку
в нашем
издании?