• Добавить в закладки
  • Facebook
  • Twitter
  • Telegram
  • VK
  • Печать
  • Email
  • Скопировать ссылку
7 апреля, 13:43
Редакция Naked Science
3
1,9 тыс

Яндекс внедрил в Поиск гибридную ИИ‑архитектуру, созданную на базе научных исследований

❋ 3.8

Компания объединила подходы «смеси экспертов» (Mixture of Experts, MoE) и «энкодер-декодер» (encoder-decoder, «кодировщик-декодировщик»), рассказала технический директор Яндекс Поиска Екатерина Серажим на конференции «День Поиска 2026». В компании подчеркнули, что такое объединение методов ранее существовало в основном на уровне научных исследований, а не практических технологий.

Екатерина Серажим / © Яндекс

В последнее время мировые поисковые системы уделяют все больше внимания прямым ответам на запросы. То есть когда человек вбивает что-то в поиск, кроме выдачи ссылок, он получает в самом верху ответ, который нейросеть генерирует «на лету», в виде связного текста. «Генеративные ответы — важная часть пользовательского опыта. Такие ответы должны соответствовать требованиям Поиска: быть быстрыми, лаконичными и эффективно работать на большом потоке запросов», — отметила Екатерина Серажим.

Для решения довольно непростой задачи компания развивает отдельный набор моделей — Alice AI Search, оптимизированный под задачи поиска. «За последний год мы внедрили улучшения во всех частях технологии — от обучения претрейн-моделей до оптимизации инфраструктуры», — добавила она.

По ее словам, для таких моделей требуется и особая архитектура, так как в Поиске им приходится почти мгновенно анализировать большой объем информации из веб-документов. Это отличается от стандартного подхода нейросетей к генерации ответов. Поэтому важно использовать решения, которые обеспечивают высокое качество выдачи при ограниченных вычислительных ресурсах.

Технический директор пояснила, что в экспериментах компании архитектура «энкодер-декодер» — где одна часть модели анализирует запрос и документы, а другая формирует ответ — при работе с большим объемом данных показала результаты лучше классических языковых моделей. Чтобы ускорение работы модели шло без потери качества, компания использовала подход Mixture of Experts (MoE).

Это принятая в индустрии архитектура, которая позволяет значительно увеличить количество параметров модели (очень условно — ее «знания»), не увеличивая при этом вычислительные затраты на каждый отдельный запрос.

Если обычная нейросетевая модель при каждом слове активирует все свои нейроны («плотная» модель), то MoE-модель активирует только малую часть своих мощностей («разреженная» модель). «Экспертами» в модели называют отдельные подсети, каждая из которых «учится» обрабатывать определенные типы данных. Один «эксперт» может хорошо разбираться в программировании, другой — в биологии, третий — в написании деловых писем.

Серажим отметила, что MoE позволяет задействовать только часть модели для генерации каждого следующего токена, что ускоряет работу и повышает эффективность.

«В Поиске модель должна одновременно работать с большим объемом данных и укладываться в жесткие ограничения по скорости и стоимости на каждом запросе. Нам удалось модифицировать архитектуру, добавив слои MoE. В совокупности все улучшения, включая создание гибридной архитектуры, позволили нам повысить качество и совокупно снизить стоимость инференса в три раза. В результате покрытие ИИ-ответами в Поиске (доля запросов, на которые Поиск сразу даёт генеративный ответ) выросло за год в 1,5 раза», — подытожила она. Инференсом в данном контексте называют процесс работы нейросети над генеративным ответом пользователю, задающему вопрос в поисковике.

Внедрение компанией сочетания архитектур MoE и «энкодер-декодер» из научных исследований в промышленный поиск показывает, как такие разработки переходят в практическое применение — уже с учетом жестких требований к скорости, стабильности и стоимости инфраструктуры.

Нашли опечатку? Выделите фрагмент и нажмите Ctrl + Enter.
Подписывайтесь на нас в Telegram, Яндекс.Новостях и VK
Предстоящие мероприятия
19 августа, 18:31
Александр Березин

После сокращения длины очередей и роста доступности бензина в первую неделю августа ситуация снова ухудшилась. Если с 20 июня по начало августа кризис носил в основном психологический характер, то сейчас ситуация принципиально иная: августовские атаки на НПЗ показали, что меры по усилению их противовоздушной обороны не были достаточно полными. Значит, прогноз автора Naked Science от 19 июля о том, что острая фаза кризиса закончится до конца лета, был частично неверным.

20 августа, 11:56
Татьяна Зайцева

Множество переломов костей у средневекового скелета, захороненного в замке Стерлинг, позволили предположить, что мужчина погиб в результате прямого попадания снаряда, выпущенного из осадного орудия. Не исключено, что это был гигантский требушет «Боевой Волк», построенный по приказу короля Англии Эдуарда I.

19 августа, 12:49
Мария Азарова

Воспоминания не исчезают бесследно: иногда пережитый опыт перестает влиять на поведение, хотя его след продолжает сохраняться в мозге. Ученые решили проверить, можно ли вернуть такую «забытую» память и что произойдет, если напомнить о произошедшем не совсем точно.

16 августа, 11:45
Татьяна Зайцева

В черепах участников битв эпохи Средневековья часто находят отверстия квадратной формы, о происхождении которых спорят специалисты. Авторы нового исследования пришли к выводу, что такое повреждение — следствие смертельного удара по голове палицей.

17 августа, 12:59
Марк Чернов

Анализ почти 69 тысяч видов насекомых помог опровергнуть главенствующую теорию эволюции, которая полвека объясняла устройство колоний пчел, муравьев и ос. Исследователи выяснили, что общепринятый генетический фактор сам по себе не приводит к разделению труда, а настоящий секрет их коллективного выживания кроется в совсем других биологических чертах.

19 августа, 18:31
Александр Березин

После сокращения длины очередей и роста доступности бензина в первую неделю августа ситуация снова ухудшилась. Если с 20 июня по начало августа кризис носил в основном психологический характер, то сейчас ситуация принципиально иная: августовские атаки на НПЗ показали, что меры по усилению их противовоздушной обороны не были достаточно полными. Значит, прогноз автора Naked Science от 19 июля о том, что острая фаза кризиса закончится до конца лета, был частично неверным.

31 июля, 14:12
Андрей Серегин

Долгое время считалось, что до прихода европейцев тропические леса Амазонии были заселены сравнительно плохо. Однако выяснилось, что плотная растительность скрывает большинство следов древних обществ. С помощью воздушного лазерного сканирования ученые обнаружили сотни неизвестных земляных сооружений и предположили, что около двух тысяч лет назад население юго-западной части Амазонии могло достигать трех миллионов человек.

9 августа, 19:34
Марк Чернов

Американская компания Firebird официально запустила в городе Раздан крупный центр обработки данных и фабрику искусственного интеллекта. На сегодняшний день это самый масштабный технологический хаб подобного уровня в СНГ, а после завершения всех этапов строительства он войдет в пятерку самых мощных вычислительных кластеров в мире.

4 августа, 12:03
Александр Березин

Остров Пекан недалеко от Мексиканского залива в Луизиане вскоре перейдет в собственность компании Илона Маска. Здесь будет новый космодром для Starship, почти в 20 раз больше, чем в Бока-Чике, где уже стоят две стартовых площадки. Уникальное местоположение позволит компании попытаться реализовать амбициозную цель о запуске миллиона низкоорбитальных спутников на орбиты, где сегодня находится подавляющее меньшинство спутников Земли.

[miniorange_social_login]

Комментарии

3 Комментария
Пользуюсь только Google поисковиком и AI-нейросетью там в поисковике (на базе Gemini Flash). Ищет точнее по запросу, что критично для точных данных и программирования. Эта нейосеть великолепна, работает по актуальным данным (что критично при запросах по программированию, когда обычные нейросети имеют устаревшие нерабочие данные об API библиотек). Для более сложных запросов есть другие нейросети. +Есть Google Books. Лет 10 назад я очень радовался внедрению нейросети в Яндекс Поиск (в обработку семантики запроса, не путать с ответами нейросети). Была патриотичная гордость. Но всё превратилось в рекламно-пропагандную помойку, дзен-маилсру-чебурнет. Пользоваться невозможно. Да и многие разрабы Яндекса свалили за границу, не говоря про то, что домен яндекса увел dzen, превратив в ту самую помойку. Алиса...😏 Для простых общих запросов для народа, как национальная нейросеть... возможно. Но для вопросов по делу - совершенно бесполезна, только тратит время. Для программирования и картинок тот же GigaChat/GigaCode лучше и бесплатные китайцы (DeepSeek, GLM, Qwen). Блин, она даже фильмы, песни и обществ.движения 2000х годов найти не может по описанию... Только рекламу сует фигни всякой...🤬
Да ну. Как был бред на сложные и редкие запросы, так и есть. Причём, беда всех нейросетей, она ещё и подвирает, лишь бы угодить. Проблема то банальная. На простые и частые запросы есть ответы людей, которые нейросеть обобщает и выдаёт. Но я и так могу найти нужную информацию, еë ведь полно. А вот редкий и сложный запрос нейросеть ставит в тупик и она начинает врать, лишь бы дать ответ.
К сожалению, Яндекс назвать мировой поисковой системой можно лишь условно. Да, он удобен, быстр и функционален, однако не все показанные в результатах поиска ссылки можно открыть. Хорошо это или плохо - не знаю.