• Добавить в закладки
  • Facebook
  • Twitter
  • Telegram
  • VK
  • Печать
  • Email
  • Скопировать ссылку
23 июля, 10:13
Редакция Naked Science
4,2 тыс

Исследователи «Яндекса» решили проблему «катастрофического забывания» голосовых помощников

❋ 4.7

Исследователи «Яндекса» предложили способ решить проблему «катастрофического забывания» при обновлении слов-триггеров для умных устройств. Гаджеты смогут узнавать новые голосовые команды, продолжая распознавать уже известные. Исследование с описанием подхода авторы представят на международной конференции Interspeech 2026, которая пройдет с 27 сентября по 1 октября в Сиднее.

© Unsplash

Производители умных колонок, автомобильных ассистентов и других голосовых помощников регулярно расширяют набор фраз, которые устройства понимают без подключения к сети. Для этого модель обычно дообучают. Но после обновления устройства иногда начинают хуже понимать уже знакомые команды. Специалисты машинного обучения называют такой эффект «катастрофическим забыванием» (catastrophic forgetting). Чтобы решить эту проблему, разработчики используют методы непрерывного обучения (continual learning) — например, эластичное закрепление весов (elastic weight consolidation, EWC). Однако они позволяют уменьшить эффект, но не устраняют его полностью.

Исследователи «Яндекса» предложили другой подход к решению проблемы «катастрофического забывания» — модульное расширение модели. Он также требует меньше вычислительных ресурсов по сравнению с другими методами, например, низкоранговой адаптацией (low-rank adaptation, LoRA) и адаптерами.

Метод «Яндекса» предлагает не менять всю работающую нейросеть, а добавлять небольшой новый модуль — дополнительную обучаемую ветку, отвечающую за распознавание новых команд.

Новая ветка использует признаки, которые извлекает основная модель, а для новых команд у нее есть собственный классификатор. При этом параметры базовой модели не меняются, в том числе параметры нормализации и основной классификатор. Модель продолжает распознавать старые команды так же точно, как до обновления. Новые команды можно добавить, обучая только дополнительный модуль, не перестраивая всю систему. Новый метод лишь немного увеличивает размер нейросети — менее чем на 10%.

Авторы проверили эффективность подхода на открытом датасете Google Speech Commands. В экспериментах они обучали модель новым парам команд, при этом распознавание уже знакомых слов не должно было пострадать. Метод снизил среднюю долю пропущенных новых команд (false reject rate, FRR) с 6,46% до 4,37% по сравнению с отдельной моделью аналогичного размера. Новый подход превзошел методы адаптеров и LoRA. При обычном полном дообучении всей модели она хорошо усваивала новые команды, но старые распознавала хуже: средняя доля забытых старых команд возрастала с 2,71% до 69,08%.

Исследователи считают, что такой подход можно использовать для умных колонок, бытовой техники, автомобильных голосовых помощников и других устройств с ограниченными вычислительными ресурсами.

Нашли опечатку? Выделите фрагмент и нажмите Ctrl + Enter.
Подписывайтесь на нас в Telegram, Яндекс.Новостях и VK
Предстоящие мероприятия
29 августа, 16:51
Александр Березин

Госдолг США достиг 40 триллионов долларов и растет все быстрее и быстрее. На Западе переполох: при таких размерах его не выплатить. Следовательно, полагают многие, надо решить проблему как древние шумеры — долг обнулить и начать занимать заново. Рецепт кажется здравым, но есть нюансы. Причем поучительнее всего они даже не для Штатов, а, как ни странно, именно для России.

31 августа, 09:44
Evgenia Vavilova

Обычно место соединения двух деталей, даже из одного материала — слабая точка изделия. Но правильно сваренные друг с другом куски полиэтилена это правило нарушали, хотя ученые и не понимали почему.

30 августа, 16:26
Александр Березин

Телескоп «Роман» в несколько раз превосходит любого из своих американских предшественников по числу мегапикселей в матрице и будет отправлять на Землю больше данных, чем любой другой космический телескоп из когда-либо созданных. С его помощью астрономы надеются и прояснить природу темной энергии и материи, и найти немало новых экзопланет — в особенности планет-бродяг

28 августа, 15:43
Татьяна Зайцева

Сопротивление жителей Европы самой идее употребления насекомых в пищу может иметь эволюционные корни, уходящие вглубь тысячелетий, пришли к выводу авторы нового исследования. Оказалось, предки современных европейцев ели насекомых лишь эпизодически. Кроме того, из-за генетических мутаций они плохо переваривали их экзоскелеты.

29 августа, 16:51
Александр Березин

Госдолг США достиг 40 триллионов долларов и растет все быстрее и быстрее. На Западе переполох: при таких размерах его не выплатить. Следовательно, полагают многие, надо решить проблему как древние шумеры — долг обнулить и начать занимать заново. Рецепт кажется здравым, но есть нюансы. Причем поучительнее всего они даже не для Штатов, а, как ни странно, именно для России.

30 августа, 16:26
Александр Березин

Телескоп «Роман» в несколько раз превосходит любого из своих американских предшественников по числу мегапикселей в матрице и будет отправлять на Землю больше данных, чем любой другой космический телескоп из когда-либо созданных. С его помощью астрономы надеются и прояснить природу темной энергии и материи, и найти немало новых экзопланет — в особенности планет-бродяг

9 августа, 19:34
Марк Чернов

Американская компания Firebird официально запустила в городе Раздан крупный центр обработки данных и фабрику искусственного интеллекта. На сегодняшний день это самый масштабный технологический хаб подобного уровня в СНГ, а после завершения всех этапов строительства он войдет в пятерку самых мощных вычислительных кластеров в мире.

28 августа, 15:43
Татьяна Зайцева

Сопротивление жителей Европы самой идее употребления насекомых в пищу может иметь эволюционные корни, уходящие вглубь тысячелетий, пришли к выводу авторы нового исследования. Оказалось, предки современных европейцев ели насекомых лишь эпизодически. Кроме того, из-за генетических мутаций они плохо переваривали их экзоскелеты.

19 августа, 18:31
Александр Березин

После сокращения длины очередей и роста доступности бензина в первую неделю августа ситуация снова ухудшилась. Если с 20 июня по начало августа кризис носил в основном психологический характер, то сейчас ситуация принципиально иная: августовские атаки на НПЗ показали, что меры по усилению их противовоздушной обороны не были достаточно полными. Значит, прогноз автора Naked Science от 19 июля о том, что острая фаза кризиса закончится до конца лета, был частично неверным.

[miniorange_social_login]

Комментарии

Написать комментарий