28.10.2024, 15:59
Редакция Naked Science
254

Российские ученые повысили точность рекомендательных систем для соцсетей и онлайн-магазинов на 50 процентов

❋ 4.6

Сотрудники лаборатории исследований искусственного интеллекта T-Bank AI Research существенно улучшили работу автоматизированной рекомендательной системы. Ключевым звеном в их решении стала существенная оптимизация одного из самых популярных алгоритмов для подбора рекомендаций.

Оптимизированный алгоритм назван по имени британского математика и священника Томаса Байеса, чьи подходы к анализу вероятностей нашли в нем применение / © Wikimedia Commons

Научная группа из T-Bank AI Research серьезно оптимизировала алгоритм байесовского персонализированного ранжирования (БПР) — один из ключевых компонентов рекомендательных систем современных соцсетей и онлайн-магазинов. Именно на ее основе реализованы почти все новостные ленты в соцсетях, как и рекомендации пользователям при онлайн-шопинге.

Этот алгоритм анализирует множество переменных и их вероятностных зависимостей так, чтобы уловить, какие именно действия человека в соцсети (или потенциального покупателя в магазине) чаще всего вероятностно связаны с его выбором того, на какую именно новость, пост или товар он хочет кликнуть. БПР крайне популярно из-за относительно умеренных требований к ресурсам при достаточно высокой эффективности.

Авторы новой работы представили ее на ключевой Всемирной конференции по рекомендательным системам ACM RecSys, которая прошла с 14 по 18 октября в Бари (Италия). Текст принят к публикации в сборнике работ конференции Reproducibility track of the ACM RecSys и доступен на сервере препринтов Корнеллского университета. Исследователи взялись проанализировать, в каких именно случаях БПР справляется со своими задачами хуже или лучше обычного.

В результате ученым удалось показать, что практическая реализация БПР часто бывает весьма разной и в целом ряде случаев как минимум неоптимальна. Исходная научная работа о БПР, вышедшая 15 лет назад, хотя и получила едва ли не семь тысяч цитирований в других научных статьях, похоже, не всегда достаточно тщательно изучалась теми, кто брался за ее реализацию. По оценкам исследователей, итоговое снижение эффективности алгоритма в реализации может достигать 50% от максимальной, теоретически возможной, эффективности.

Результаты воспроизведения оригинального алгоритма в сравнении с моделями из разных опенсорс-фреймворков. Модель авторов работы (Ours) превосходит модели из большинства опенсорс-фреймворков  / ©  Лаборатория T-Bank AI Research

Авторы не ограничились этим выводом. Они также создали свою модель БПР и тщательно настроили ее гиперпараметры (так называют параметры, настраиваемые до запуска модели и неизменяемые в процессе ее работы). Затем протестировали ее эффективность на задачах из реального мира. Результаты оказались выше, чем у других реализаций модели.

Например, производительность в точных рекомендациях вышла на 50% выше, чем у модели из популярного опенсорс-фреймворка RecBole. Кроме того, она была на 10% выше, чем у модели Mult-VAE. Отметим, что Mult-VAE — модель для рекомендательных систем, основанная на нейронных сетях (разработка лаборатории Netflix), и считается одним из лидеров в отрасли, если не бесспорным лидером.

Сравнение эффективности для всех моделей шло по одному сценарию на одном и том же наборе данных — так называемом Наборе из миллиона песен. Критерием точности работы модели было то, насколько точно первые сделанные ею 100 рекомендаций совпали с интересами пользователя, проходящего через модель.

Поскольку работа исследователей из научно-исследовательской лаборатории T-Bank AI Research теперь в открытом доступе (и есть на GitHub), ее могут применять разработчики по всему миру для оптимизации самых разных рекомендательных систем. Это позволит покупателям быстрее находить нужные им товары в интернет-магазинах, а пользователям соцсетей — получать более осмысленную выдачу в лентах новостей и подписках. Как не раз отмечал Naked Science, проблемы с такими лентами давно стали буквально бичом для множества современных людей.

Нашли опечатку? Выделите фрагмент и нажмите Ctrl (Cmd) + Enter.
Подписывайтесь на нас в Telegram, Дзен и в последнюю очередь на VK
Предстоящие мероприятия
17 сентября, 10:59
НИУ ВШЭ

Экономисты НИУ ВШЭ выяснили, что российские сотрудники, которые регулярно пользуются искусственным интеллектом в работе, зарабатывают намного больше тех, кто отказывается от новых инструментов или прибегает к ним время от времени. Среди высококвалифицированных специалистов прибавка достигает 41,8%.

16 сентября, 12:12
Александр Березин

Спустя три года после начала испытательных полетов крупнейшую ракету и космический корабль в истории человечества объявили готовыми к первому запуску на орбиту. Причем его планируют сразу десятичасовым и с выводом большой группы спутников Starlink нового поколения. По пропускной способности один этот запуск добавит столько же, сколько десять запусков Falcon 9, современного лидера серийного земного ракетостроения.

17 сентября, 14:43
Татьяна Зайцева

Авторы нового масштабного исследования выявили оптимальное количество порций бурого риса, овсянки, гречки и других изделий из цельного зерна в дневном рационе, которое позволяет существенно снизить риск кардиометаболических заболеваний.

16 сентября, 12:12
Александр Березин

Спустя три года после начала испытательных полетов крупнейшую ракету и космический корабль в истории человечества объявили готовыми к первому запуску на орбиту. Причем его планируют сразу десятичасовым и с выводом большой группы спутников Starlink нового поколения. По пропускной способности один этот запуск добавит столько же, сколько десять запусков Falcon 9, современного лидера серийного земного ракетостроения.

16 сентября, 14:29
Татьяна Зайцева

Анализ данных о почти 300 тысячах километров римских дорог, проложенных по территории бывшей империи, показал, что они вовсе не были такими прямыми, как принято считать. Кроме того, выяснилось, что известная поговорка «Все дороги ведут в Рим» тоже не соответствует истине.

17 сентября, 10:59
НИУ ВШЭ

Экономисты НИУ ВШЭ выяснили, что российские сотрудники, которые регулярно пользуются искусственным интеллектом в работе, зарабатывают намного больше тех, кто отказывается от новых инструментов или прибегает к ним время от времени. Среди высококвалифицированных специалистов прибавка достигает 41,8%.

9 сентября, 22:44
Александр Березин

Нейросеть OpenAI добилась серьезного прорыва в математике, решив одну из семи «задач тысячелетия». Получат ли США, чьи нейросети опираются на гораздо более мощное «железо», чем у Китая, монополию на конвейер научных открытий? Даст ли это возможности сравнимые с их атомной монополией 80 лет назад?

28 августа, 15:43
Татьяна Зайцева

Сопротивление жителей Европы самой идее употребления насекомых в пищу может иметь эволюционные корни, уходящие вглубь тысячелетий, пришли к выводу авторы нового исследования. Оказалось, предки современных европейцев ели насекомых лишь эпизодически. Кроме того, из-за генетических мутаций они плохо переваривали их экзоскелеты.

19 августа, 18:31
Александр Березин

После сокращения длины очередей и роста доступности бензина в первую неделю августа ситуация снова ухудшилась. Если с 20 июня по начало августа кризис носил в основном психологический характер, то сейчас ситуация принципиально иная: августовские атаки на НПЗ показали, что меры по усилению их противовоздушной обороны не были достаточно полными. Значит, прогноз автора Naked Science от 19 июля о том, что острая фаза кризиса закончится до конца лета, был частично неверным.

[miniorange_social_login]

Комментарии

Написать комментарий