В ВШЭ придумали турниры для рекомендательных алгоритмов
Исследователи Института искусственного интеллекта и цифровых наук ФКН НИУ ВШЭ разработали подход, который помогает эффективнее подбирать рекомендательные алгоритмы. В нем разные методы попарно соревнуются, а по результатам всех поединков составляется общий рейтинг. Это помогает сократить число алгоритмов, которые нужно проверять при разработке новых сервисов, и сэкономить денежные и временные ресурсы.
Рекомендательные системы решают, какие товары, фильмы, песни или публикации показать пользователю. Для этого они анализируют его действия и пытаются предсказать, что может заинтересовать его в дальнейшем. Например, ищут посетителей с похожими интересами, учитывают последовательность просмотров или покупок.
При этом универсального алгоритма рекомендаций нет. Метод может хорошо работать в интернет-магазине, но не подойти для онлайн-кинотеатра. Поэтому обычно алгоритмы предварительно проверяют на уже собранных наборах данных и усредняют получившиеся результаты. Но у такого способа есть недостатки: рейтинг не учитывает особенности конкретного набора данных и может быть нестабильным, а проверять все алгоритмы онлайн, на реальных пользователях, дорого и рискованно.
Исследователи НИУ ВШЭ разработали методику для сравнения рекомендательных алгоритмов на основе модели Брэдли — Терри, которую используют для составления рейтингов по результатам парных соревнований. В исследовании игроками выступали рекомендательные алгоритмы, а матчами — проверки на наборах данных. Два алгоритма сопоставляли по выбранной метрике: например, по точности рекомендаций. Тот, у кого показатель был выше, считался победителем. По результатам всех таких сравнений модель оценивала относительную силу каждого алгоритма. Авторы обучили и проверили 14 алгоритмов на 89 наборах данных из разных областей. Исследование было представлено на 32-й конференции ACM SIGKDD Conference on Knowledge Discovery and Data Mining (KDD 2026).
Результаты показали, что одни и те же алгоритмы занимали разные места в рейтинге в зависимости от типа данных в поединке. Например, на последовательных наборах, где важен порядок действий пользователя, первые места заняли SASRec и GASATF. На данных без выраженной последовательности они опустились на десятое и одиннадцатое места, а первые позиции заняли LightGCN и ALS.
Дополнительно исследователи проверили, насколько рейтинги устойчивы к неполным данным. Рейтинг на основе модели Брэдли — Терри оставался стабильным, даже если отсутствовала часть сравнений (не каждый игрок сыграл с каждым). Также авторы проверили на дополнительных наборах данных расширенную версию модели, которая учитывает контекст. Она должна была предсказать победителей без непосредственного сравнения алгоритмов для построения рейтинга.
«Идея использовать спортивную модель пришла к нам благодаря работам нашего старшего коллеги Спокойного В.Г. Если приводить аналогию со спортом, на исход поединка влияют не только сами участники, но и условия — например, город или погода. В исследовании таким контекстом стали характеристики набора данных: число пользователей и объектов, средняя длина истории пользователя и другие параметры. Если обучить модель учитывать этот контекст вместе с результатами предыдущих сравнений, то по характеристикам нового набора она может заранее оценить, какие алгоритмы окажутся лучшими», — комментирует один из авторов статьи, эксперт Международной лаборатории стохастических алгоритмов и анализа многомерных данных Антон Лысенко.
В 78% случаев алгоритм, который занимал первое место, действительно входил в тройку лучших. При обычном усреднении показателей это происходило только в 16% случаев. Авторы объясняют это тем, что, в отличие от эвристических способов сравнения, модель теоретически обоснована, поэтому получаемый рейтинг надежнее.
«Наш подход помогает еще до онлайн-тестирования понять, какие алгоритмы лучше подходят для конкретного набора данных. Например, если банку нужно рекомендовать программы лояльности, можно передать модели характеристики нового набора данных и получить несколько наиболее перспективных вариантов. Тогда на реальных пользователях нужно будет проверять уже только их, а не все доступные алгоритмы. Это позволяет сэкономить время и ресурсы», — комментирует один из авторов статьи, заведующий Международной лабораторией стохастических алгоритмов и анализа многомерных данных Сергей Самсонов.
Биологи провели молекулярный анализ тканей человеческого мозга и выяснили, что при тяжелой депрессии останавливается процесс образования новых нейронов. Открытие показало, что природа заболевания кроется не только в химическом дисбалансе нейромедиаторов, но и в физическом нарушении клеточного обновления гиппокампа.
Известное исследование прошлого, показавшего позитивный эффект от уменьшения экранного времени, слишком сильно доверялось словам участников эксперимента. Проверка показала, что в реальности люди почти полностью проваливают попытку уменьшить свою зависимость от телефона.
Проблемы с дыханием во время сна могут отражаться не только на самочувствии днем, но и на интимной жизни мужчин. Новый метаанализ показал, что по мере усугубления таких нарушений во сне показатели эректильной функции снижаются.
Биологи провели молекулярный анализ тканей человеческого мозга и выяснили, что при тяжелой депрессии останавливается процесс образования новых нейронов. Открытие показало, что природа заболевания кроется не только в химическом дисбалансе нейромедиаторов, но и в физическом нарушении клеточного обновления гиппокампа.
Большой адронный коллайдер многие воспринимают как инструмент изучения первых мгновений жизни Вселенной и поиска редких частиц. Но ушедший на обновление ускоритель частиц все еще приносит новые данные и о таких, казалось бы, хорошо изученных объектах, как ядро атома кислорода. Физики ЦЕРН выяснили, что и оно, и ядро атома неона ведут себя не так, как предсказывали модели.
Вполне возможно, что примерно 55 тысяч лет назад неандертальцы обитали гораздо южнее, чем считалось до сих пор. На то, что они могли приспособиться к жизни в условиях пустыни, указали каменные орудия, обнаруженные на Аравийском полуострове.
Долгое время считалось, что до прихода европейцев тропические леса Амазонии были заселены сравнительно плохо. Однако выяснилось, что плотная растительность скрывает большинство следов древних обществ. С помощью воздушного лазерного сканирования ученые обнаружили сотни неизвестных земляных сооружений и предположили, что около двух тысяч лет назад население юго-западной части Амазонии могло достигать трех миллионов человек.
Американская компания Firebird официально запустила в городе Раздан крупный центр обработки данных и фабрику искусственного интеллекта. На сегодняшний день это самый масштабный технологический хаб подобного уровня в СНГ, а после завершения всех этапов строительства он войдет в пятерку самых мощных вычислительных кластеров в мире.
После сокращения длины очередей и роста доступности бензина в первую неделю августа ситуация снова ухудшилась. Если с 20 июня по начало августа кризис носил в основном психологический характер, то сейчас ситуация принципиально иная: августовские атаки на НПЗ показали, что меры по усилению их противовоздушной обороны не были достаточно полными. Значит, прогноз автора Naked Science от 19 июля о том, что острая фаза кризиса закончится до конца лета, был частично неверным.
Вы попытались написать запрещенную фразу или вас забанили за частые нарушения.
Понятно
Что-то в вашем комментарии показалось подозрительным, поэтому перед публикацией он пройдет модерацию.
Понятно
Из-за нарушений правил сайта на ваш аккаунт были наложены ограничения. Если это ошибка, напишите нам.
Понятно
Наши фильтры обнаружили в ваших действиях признаки накрутки. Отдохните немного и вернитесь к нам позже.
Понятно
Мы скоро изучим заявку и свяжемся с Вами по указанной почте в случае положительного исхода. Спасибо за интерес к проекту.
Понятно
