• Добавить в закладки
  • Facebook
  • Twitter
  • Telegram
  • VK
  • Печать
  • Email
  • Скопировать ссылку
09.09.2025, 16:54
Редакция Naked Science
8
2,3 тыс

Исследователи «Яндекса» представили способ повысить качество работы рекомендательных систем

❋ 4.7

Исследователи рекомендательных технологий «Яндекса» нашли способ, как повысить качество работы рекомендательных систем, чтобы они лучше понимали предпочтения пользователей, например, в товарах или контенте, и составляли более точные рекомендации. Для этого исследователи внедрили дополнительную корректировку в процесс обучения таких моделей.

Рекомендательные системы сегодня массовы, а их обучение превратилось в весьма ресурсоемкий процесс. Можно ли его облегчить? / © Вастрик, vas3k.blog

Внутреннее тестирование «Яндекса» показало, что новый подход позволяет повысить точность рекомендаций моделей в среднем на семь процентов по показателям качества ранжирования. «Яндекс» планирует использовать метод при обучении рекомендательных моделей собственных сервисов, в частности «Маркета». Метод будет полезен и другим компаниям, а также независимым разработчикам, работающим с рекомендательными системами в любой сфере — будь то соцсеть, интернет-магазин или стриминговый сервис.

О новом методе исследователи «Яндекса» рассказали в научной статье, которая была принята на ACM RecSys 2025. Это главная ежегодная международная конференция по рекомендательным системам, которая в этом году пройдет в девятнадцатый раз в Чехии. На конференцию также приняты работы крупнейших мировых технологических компаний — Amazon, Google и других.

Неточности при обучении рекомендательных систем

Рекомендательные системы обычно работают с миллионами объектов — текстами, аудио, видео, товарами. Это требует больших вычислительных ресурсов. Но сначала модель нужно обучить также на миллионах примеров, и для этого тоже необходимо много ресурсов. Чтобы сделать этот процесс менее ресурсоемким, во всем мире используют разные методы, которые заменяют сложные расчеты на более простые. Один из таких методов — sampled softmax, или алгоритм выборочного сэмплирования.

Его суть в том, что систему обучают различать предпочтения людей путем сравнения реализованных действий, которые пользователи совершили по отношению к конкретному объекту (положительные примеры), с нереализованными действиями, которых они не совершали относительно того же объекта (отрицательные примеры). В качестве объекта, например, может выступать определенный товар, тогда положительный пример — это добавление в корзину, а отрицательный — просмотр на сайте без добавления.

Обучение системы строится на том, что ей показывают положительный пример и отрицательные, — и благодаря этому модель начинает отличать одно от другого. Но можно показать ей миллионы отрицательных примеров из обучающего каталога, а можно лишь несколько случайно выбранных — в этом и заключается преимущество метода sampled softmax, которое позволяет экономить вычислительные ресурсы. Однако этот метод может привести к некачественному обучению из-за некорректного учета вероятностей — актуальна ли для пользователя рекомендация или нет. В результате модель будет давать неверные рекомендации.

Решение с помощью новой формулы

Для корректной работы метода требуется использовать обновленную формулу пересчета вероятностей того, что пользователь заинтересуется определенным товаром или контентом, — LogQ. Главная математическая трудность была в том, что существующие методы предполагают одинаковые правила отбора для всех примеров, а на практике положительные и отрицательные примеры попадают в данные по-разному. Из-за этого стандартные формулы начинают систематически искажать оценки, и требовалось специально скорректировать пересчет вероятностей, чтобы сделать модель объективнее.

Благодаря формуле модель при обучении начинает понимать, что реальные действия пользователя выбираются не случайным образом и явно задаются ей как положительные примеры, а остальные примеры — отрицательные и выбраны случайно. Это позволяет уменьшить смещения в оценках со стороны модели, то есть искажения, влияющие на точность ее финальных рекомендаций. В результате модель лучше понимает предпочтения пользователей и, как следствие, дает им более подходящие рекомендации.

Компании и разработчики могут использовать новую формулу при обучении любой рекомендательной системы. Для этого им не придется менять архитектуру своих моделей.

Нашли опечатку? Выделите фрагмент и нажмите Ctrl + Enter.
Подписывайтесь на нас в Telegram, Яндекс.Новостях и VK
Предстоящие мероприятия
7 сентября, 12:55
НовГУ

91% родителей считают игры важными для развития ребенка, однако лишь единицы сами предлагают детям поиграть. Взрослые сильно тревожатся из-за увлечения детей смартфонами, хотя зачастую сами преувеличивают время, которое школьники проводят в сети. К таким выводам пришли ученые НовГУ, изучив, как гаджеты и занятость взрослых меняют досуг младшеклассников.

7 сентября, 11:15
Росатом

Акционерное общество «Росатом — Возобновляемая энергия» построит в Амурской области завод по сборке элементов ветрогенераторов. Оборудование потребуется для будущих ветроэлектростанций на Дальнем Востоке. Сейчас крупные детали производят практически в другом конце страны. Собирать крупные узлы на месте будет дешевле, чем везти их.

7 сентября, 15:18
Александр Березин

С помпой объявленный два года назад проект Илона Маска наконец стал официально перевозить людей. Американские власти уже начали аудит того, насколько легальны такие машины, многие сомневаются в успешности проекта для Tesla. Впрочем, у него есть проблемы куда серьезнее и аудита, и плохого отношения западных медиа к главе компании.

2 сентября, 11:31
СПбГУ

Группа российских исследователей, в которую вошли океанологи Санкт-Петербургского университета, выявила существование ранее неизвестных механизмов распространения «волн Россби». В ходе работы им удалось зафиксировать точки, где перенос энергии прекращается, а траектории движения воды претерпевают изменения. Дополнительно ученые обнаружили асимметрию в динамике волновых процессов, зарождающихся у западных и восточных прибрежных течений.

3 сентября, 17:08
Росатом

«Росатом» рассматривает возможность создать под Мурманском новое предприятие для достройки плавучих атомных энергоблоков. Причина в том, что количество заказов госкорпорации растет, а существующих мощностей партнеров может не хватить.

1 сентября, 12:12
НовГУ

В XIV и XV веках состоятельные новгородцы отдавали предпочтение импортной одежде насыщенного красного цвета, а главным поставщиком европейских тканей на Русь выступал Ганзейский союз. Детали этой торговли исследовала аспирант НовГУ Елизавета Калугина.

9 августа, 19:34
Марк Чернов

Американская компания Firebird официально запустила в городе Раздан крупный центр обработки данных и фабрику искусственного интеллекта. На сегодняшний день это самый масштабный технологический хаб подобного уровня в СНГ, а после завершения всех этапов строительства он войдет в пятерку самых мощных вычислительных кластеров в мире.

28 августа, 15:43
Татьяна Зайцева

Сопротивление жителей Европы самой идее употребления насекомых в пищу может иметь эволюционные корни, уходящие вглубь тысячелетий, пришли к выводу авторы нового исследования. Оказалось, предки современных европейцев ели насекомых лишь эпизодически. Кроме того, из-за генетических мутаций они плохо переваривали их экзоскелеты.

19 августа, 18:31
Александр Березин

После сокращения длины очередей и роста доступности бензина в первую неделю августа ситуация снова ухудшилась. Если с 20 июня по начало августа кризис носил в основном психологический характер, то сейчас ситуация принципиально иная: августовские атаки на НПЗ показали, что меры по усилению их противовоздушной обороны не были достаточно полными. Значит, прогноз автора Naked Science от 19 июля о том, что острая фаза кризиса закончится до конца лета, был частично неверным.

[miniorange_social_login]

Комментарии

8 Комментариев
А я-то думал новый рекламный баннер добавят, странный подход к решению проблемы, неяндексовский.
Стратегия очень простая: рекомендуем бегуну купить велосипед --> а с велосипедистами работать мы уже умеем!
Яндекс уважаю и пользуюсь, но по-прежнему считаю, что Google лучше.
    Сергей, по ощущениям сплошная реклама и деньговыжимание, очень не доверяю.
    Сергей, мне нравится ии перевод на ютубе от яндекса. Я знаю английский, но не в совершенстве, но с переводом ии я просто в безграничном контенте
    +
      Еще 2 ответа
      Nikita, Google изначально был выдавал очень релевантный результат именно в научной сфере, статьи, Pubmed, патенты и др. Яндекс пытался мне что то впарить, и выдавал оч плохие по качеству статьи. Сейчас чуть лучше но засилье рекламы.
      Nikita, полностью оценить этот перевод в настоящее время, к сожалению, мне сложновато, т. к. нет такого качественного доступа к ресурсу YouTube как у вас.
Принципиальная ошибка в том, что разработчики Яндекса в этой статье кроме "болота" своих рекомендательных систем боятся нос высунуть в сторону. Эту задачу можно решать через глубокое обучение с подкреплением, ориентируясь не на правила, а на наработанный моделью опыт взаимодействия с реальными пользователями. Тут DRL-гибридная модель нужна. Тогда результат будет не 7%, а выше