21 сентября, 16:53
Елизавета З.
1
53

«Яндекс» выложил в опенсорс новую ИИ-модель, обученную с нуля

❋ 4.5

«Яндекс» опубликовал в открытом доступе Alice AI Foundation LLM — претрейн-версию новой большой языковой модели, которую разработчики обучили полностью с нуля. Она хорошо справляется с рассуждениями и задачами по программированию, а качество ответов на русском языке опережает многие зарубежные аналоги. В первую очередь это касается задач на знание фактов, интересных русскоязычной аудитории. Модель обошла даже более крупные опенсорс-модели, при этом для ее интерфейса не нужны большие вычислительные мощности. Свободная лицензия Apache 2.0. позволяет задействовать ее как в исследовательских, так и в коммерческих проектах.

Результаты моделей на бенчмарках
Результаты моделей на бенчмарках / © Яндекс

На экспериментальной версии Alice AI Foundation LLM «Яндекс» тестирует архитектурные решения для своей будущей единой рассуждающей модели (ЕРМ). ЕРМ станет основой для агентных возможностей «Алисы AI», с помощью которых пользователи смогут поручать ей выполнение конкретных действий.

Качество модели

Alice AI Foundation LLM использует архитектуру MoE (Mixture of Experts). Она содержит 80 миллиардов параметров, но для обработки запроса задействует только три миллиарда. Это позволяет обеспечить высокую скорость работы и сэкономить затраты на вычисления.

Модель умеет рассуждать и работать в агентных сценариях. Благодаря этому она эффективно решает сложные логические задания и справляется с программированием. Например, в решении олимпиадных задач по математике она лидирует вместе с Qwen3.5-35B-A3B-Base, справляясь с большинством заданий. В тестах на написание кода она обходит модель компании NVIDIA Nemotron-3-Super-120B-Base, хотя использует в четыре раза меньше активных параметров. Развитые способности к ризонингу и программированию нужны для эффективной работы агентов, которые выполняют задания по поручению пользователя.

Хотя у новой модели компактный размер и меньшая требовательность к вычислительным мощностям, она лучше решает задачи, где нужны широкие фактические знания, чем более крупные открытые модели. Обгоняет она в том числе DeepSeek-V4-Flash-Base с 284 миллиардами параметров и 13 миллиардами активных. Как показали бенчмарки для оценки знания фактов, новая модель отвечает так же хорошо, как предыдущая закрытая модель «Яндекса» Alice AI LLM, но у нее в три раза больше параметров и в семь раз больше активных.

Новые бенчмарки

Чтобы оценить знания модели, актуальные для русскоязычных пользователей, компания разработала два собственных бенчмарка: WikiWebFacts и HardMultiQA. Первый тест состоит из пар «короткий вопрос — короткий ответ». Он оценивает знание дат, определений, событий и персоналий. В его основу легли материалы онлайн-энциклопедий и популярные поисковые запросы.

Второй, HardMultiQA, разработали на основе анонимизированного потока запросов к «Алисе AI». Он затрагивает более редкие области знаний: от медицины и права до IT и искусства. Отвечая на эти вопросы, модель должна не просто вспомнить один факт, но и выбрать несколько правильных вариантов из списка, перечислить сразу несколько фактов, подходящих под условие вопроса, а также отыскать фактическую ошибку в тексте.

Новые бенчмарки разработали, чтобы оценить русскоязычные знания модели, поскольку англоязычные аналоги не могут проверить уровень объективно. «Яндекс» выложил оба бенчмарка в открытый доступ вместе с моделью. Благодаря этому разработчики и исследователи могут самостоятельно проверить результаты и сравнить модели. Также компания опубликовала эталонные ответы и полный протокол оценки.

Инженерные решения

Обучая модели, разработчики «Яндекса» улучшили работу оптимизатора — программы, отвечающей за процесс обучения. Теперь пересылка данных между видеокартами идет параллельно с вычислениями, что помогло примерно в два раза ускорить шаги оптимизации.

«Яндекс» также ускорил подготовку качественных обучающих данных. Чтобы отобрать нужные документы, их проверяли с помощью ресурсоемкой модели. Запуск модели на всем корпусе занял бы более 200 тысяч часов работы видеокарт. Теперь документы предварительно проходят через каскад классификаторов.

На каждом этапе более сложная и вычислительно затратная модель проверяет все меньшее число документов. Количество вычислений удалось сократить в десятки раз, сохранив около 95% полезных документов. Кроме того, инженеры сильно расширили базу знаний модели в сфере права, медицины и математики.

«Яндекс» представил новую модель под лицензией Apache 2.0. Ее можно будет свободно использовать как в исследовательских, так и в коммерческих целях. Разработчики уже завершили основной этап обучения, от которого зависят эрудированность, способности и потенциал модели. Теперь ее можно использовать как основу для создания собственных проектов.

Модель, технические отчеты и бенчмарки опубликовали на платформе Hugging Face, а техрепорт — на «Хабре».

Нашли опечатку? Выделите фрагмент и нажмите Ctrl (Cmd) + Enter.
Подписывайтесь на нас в Telegram, Дзен и в последнюю очередь на VK
Предстоящие мероприятия
21 сентября, 09:24
Елизавета З.

Европейское космическое агентство опубликовало снимок галактики NGC 4698, расположенной в созвездии Дева. Хотя на фотографии, сделанной телескопом «Хаббл», галактика кажется безмятежной, она хранит удивительную тайну: находящиеся в центре звезды и газ вращаются под прямым углом по отношению к остальной части диска.

21 сентября, 10:52
Елизавета З.

Королевская обсерватория в Гринвиче определила призеров ежегодного конкурса «Астрономический фотограф года». Победителем стал фотограф Али Аль-Обейдли, представивший детализированный снимок туманности Акула, напоминающей ожившего хищника.

21 сентября, 11:21
Игорь Байдов

Во время раскопок в провинции Хэнань обнаружили скелет женщины, умершей между 1298 и 1404 годами. На ее черепе ученые увидели необычно широкую, грушевидную апертуру носа и обширные повреждения носовых костей. Характер травм показал, что она получила их при жизни, а раны со временем зажили. Женщина, вероятно, подверглась карательной ампутации носа. Если данные подтвердятся, эта находка станет первым известным археологическим свидетельством такого наказания в Китае.

16 сентября, 14:29
Татьяна Зайцева

Анализ данных о почти 300 тысячах километров римских дорог, проложенных по территории бывшей империи, показал, что они вовсе не были такими прямыми, как принято считать. Кроме того, выяснилось, что известная поговорка «Все дороги ведут в Рим» тоже не соответствует истине.

21 сентября, 09:24
Елизавета З.

Европейское космическое агентство опубликовало снимок галактики NGC 4698, расположенной в созвездии Дева. Хотя на фотографии, сделанной телескопом «Хаббл», галактика кажется безмятежной, она хранит удивительную тайну: находящиеся в центре звезды и газ вращаются под прямым углом по отношению к остальной части диска.

16 сентября, 12:36
Илья Гриднев

При выборе между возможной выгодой и риском в коре головного мозга разворачивается противостояние двух независимых нейронных узлов. Нейробиологи подключились к мозгу напрямую и зафиксировали эту борьбу в реальном времени. Исследование помогло объяснить физическую природу сомнений и скрытую анатомию выбора.

9 сентября, 22:44
Александр Березин

Нейросеть OpenAI добилась серьезного прорыва в математике, решив одну из семи «задач тысячелетия». Получат ли США, чьи нейросети опираются на гораздо более мощное «железо», чем у Китая, монополию на конвейер научных открытий? Даст ли это возможности сравнимые с их атомной монополией 80 лет назад?

28 августа, 15:43
Татьяна Зайцева

Сопротивление жителей Европы самой идее употребления насекомых в пищу может иметь эволюционные корни, уходящие вглубь тысячелетий, пришли к выводу авторы нового исследования. Оказалось, предки современных европейцев ели насекомых лишь эпизодически. Кроме того, из-за генетических мутаций они плохо переваривали их экзоскелеты.

29 августа, 16:51
Александр Березин

Госдолг США достиг 40 триллионов долларов и растет все быстрее и быстрее. На Западе переполох: при таких размерах его не выплатить. Следовательно, полагают многие, надо решить проблему как древние шумеры — долг обнулить и начать занимать заново. Рецепт кажется здравым, но есть нюансы. Причем поучительнее всего они даже не для Штатов, а, как ни странно, именно для России.

[miniorange_social_login]

Комментарии

1 Комментарий
Sam Dowson
29 минут назад
Все кто использует этот недалекий ИИ видимо обладают таким же недалёким интеллектом естественным. Сравнивать новейшую супералису с квин3,5 и восхищаться, когда уже во всю квин3,8 бесплатна, это фэйспалм...