• Добавить в закладки
  • Facebook
  • Twitter
  • Telegram
  • VK
  • Печать
  • Email
  • Скопировать ссылку

Этот пост добавлен читателем Naked Science в раздел «Сообщество». Узнайте как это сделать по ссылке.

Инфографика: самые умные модели ИИ по данным теста на IQ

Искусственный интеллект создан, чтобы стать разумным. Но как современные ведущие модели ИИ выглядят с точки зрения теста на коэффициент интеллекта (IQ) и какие из них самые умные?

Инфографика: самые умные модели ИИ по данным теста на IQ / © visualcapitalist
Инфографика: самые умные модели ИИ по данным теста на IQ / © visualcapitalist

На опубликованной выше инфографике ранжированы самые умные модели ИИ на основе их результатов в тесте на IQ общества Менса. Тест Менса — это широко признанный и очень сложный экзамен на IQ для оценки человеческого интеллекта. Для сравнения: средний показатель IQ человека колеблется от 90 до 110, а показатель выше 130 обычно считается уровнем гениальности.

Возглавила список текстовая модель o3 компании OpenAI, набравшая 135 баллов в тесте Менса, что ставит ее в категорию «гениев». Как часть ChatGPT, она входит в число самых популярных в мире инструментов ИИ.  

Claude-4 Sonnet компании Anthropic и Gemini 2.0 Flash Thinking от Google идут следом с показателями 127 и 126 соответственно. Более того, новые итерации, такие как Gemini 2.5 Pro и OpenAI o4 mini, набрали более 120, что выше среднего человеческого диапазона IQ.

Пять худших моделей ИИ по баллам IQ — мультимодальные, способные читать и обрабатывать изображения. GPT-4o (Vision) от OpenAI и Grok-3 Think (Vision) от компании Илона Маска xAI показали результаты намного ниже среднего человеческого, набрав 63 и 60 баллов в тесте соответственно.

Подписывайтесь на нас в Telegram, Яндекс.Новостях и VK

Комментарии

10 Комментариев
Boris Babanov
17.06.2025
Но тест ARC-AGI 2, который все люди проходят, ни одна модель больше чем на 10% пока не прошла, и весьма вероятно не пройдет в этом году.
ViAr
17.06.2025
Не нашел в списке Алису с Марусей 🙂
    ViAr, точно не потому, что это виртуальные голосовые ассистенты нацеленные на русскозычный сегмент и не генеративные языковые модели нацеленные на англоязычный сегмент
Nadooshi CH
16.06.2025
Китайский qwen3 вне конкуренции. Ок. Продолжим им пользоваться. По мне все представленые модели, это обрубки с ограничением в 5к символов. Квен же работает с масштабом уже более 270 страниц художественного текста и выдаёт прекрасный результат. Да. Он требует редактор кой правки и иногда галлюционирует, но это не избежно при больших масштабах.
    Nadooshi, Вась очнись , иди в документацию gemini и посмотри сколько там токенов контекстное окно, какие ещё 5к?? Квен вообще ни о чем по сравнению с gemini
    +
      Еще 4 ответа
      Nadooshi CH
      16.06.2025
      Евгений, в каких странах этот хеморой доступен? Спасибо, что потратил моё время на изучение ничего.
      Nadooshi CH
      16.06.2025
      Евгений, добрался я до гемини. Все то же ограничение в 50к символов.
        Nadooshi CH
        16.06.2025
        Nadooshi, я ещё более углубился в это болото. Отвечает ещё более галлбционирующе. Требует множество уточнений. Много додумывает того, чего нет в тексте. Ужасно работает с готовыми персонажами. Анализ отвратительный. Пример: Сложный многогранный персонаж. Гримнайт - это монстр, гуманоид, не из обычного мира, а из междумирья. Разумный и способен к коммуникации. Он в процессе повествования умирает - изгоняется как демон, в междумирье. Гемини с какого-то перепугу решил что это какая то собака, которая рычит и лает в попытках общаться, а потом говорит и вся такая добрая.
      Nadooshi CH
      16.06.2025
      Евгений, я ещё более углубился в это болото. Отвечает ещё более галлюционирующе. Требует множество уточнений. Много додумывает того, чего нет в тексте. Ужасно работает с готовыми персонажами. Анализ отвратительный. Пример: Сложный многогранный персонаж. Гримнайт - это монстр, гуманоид, не из обычного мира, а из междумирья. Разумный и способен к коммуникации. Он в процессе повествования умирает - изгоняется как демон, в междумирье. Гемини с какого-то перепугу решил что это какая то собака, которая рычит и лает в попытках общаться, а потом говорит и вся такая добрая.
Roman Frolov
15.06.2025
135 - "гений"? Какая глупость. Это 2.3 стандартных отклонения выше среднего по Европе, т.е. 1 человек из 200. Это не интеллектуальные гении. Таковыми можно считать людей с IQ от 150 (SD 15). А вообще, очень странно. Chat-gpt щелкает как орешки трудные задачки из тестов на интеллект, результат должен быть выше.
Предстоящие мероприятия
12 августа, 14:39
Илья Гриднев

Эксперимент физиков из ЦЕРН позволил рассмотреть поведение глюонов внутри атомных ядер с беспрецедентной точностью. При сверхвысоких плотностях эти элементарные частицы переставали размножаться и начинали объединяться. Это помогло найти подтверждение теории «глюонного насыщения», а не принятого «ядерного затенения» для определенного диапазона сверхвысоких энергий.

11 августа, 12:44
МАИ

Со стороны профессия летчика-испытателя часто выглядит как череда опасных полетов, требующих бесстрашия и способности мгновенно импровизировать. В действительности ее основу составляют методика, дисциплина, технические знания и умение честно рассказать о каждой особенности машины. Его задача — не просто поднять самолет в воздух, но и понять, насколько точно он выполняет команды, предсказуемо ли ведет себя на сложных режимах и какие изменения необходимо внести в конструкцию или систему управления.

13 августа, 15:29
Татьяна Зайцева

Молодая женщина, возвращения которой из мертвых местное общество, по-видимому, сильно опасалось, имела скандинавские корни и поэтому могла считаться чужестранкой, предположили авторы нового исследования. Ученые также смогли установить много других интересных подробностей о жизни и смерти девушки.

9 августа, 19:34
Марк Чернов

Американская компания Firebird официально запустила в городе Раздан крупный центр обработки данных и фабрику искусственного интеллекта. На сегодняшний день это самый масштабный технологический хаб подобного уровня в СНГ, а после завершения всех этапов строительства он войдет в пятерку самых мощных вычислительных кластеров в мире.

12 августа, 14:39
Илья Гриднев

Эксперимент физиков из ЦЕРН позволил рассмотреть поведение глюонов внутри атомных ядер с беспрецедентной точностью. При сверхвысоких плотностях эти элементарные частицы переставали размножаться и начинали объединяться. Это помогло найти подтверждение теории «глюонного насыщения», а не принятого «ядерного затенения» для определенного диапазона сверхвысоких энергий.

10 августа, 11:42
Илья Гриднев

Британские экологи выяснили, что большинство людей не догадываются о вреде солнцезащитных кремов для Мирового океана. Обзор научной литературы и локальный уличный опрос наглядно продемонстрировали разрыв между реальными экологическими угрозами и повседневными привычками покупателей.

31 июля, 14:12
Андрей Серегин

Долгое время считалось, что до прихода европейцев тропические леса Амазонии были заселены сравнительно плохо. Однако выяснилось, что плотная растительность скрывает большинство следов древних обществ. С помощью воздушного лазерного сканирования ученые обнаружили сотни неизвестных земляных сооружений и предположили, что около двух тысяч лет назад население юго-западной части Амазонии могло достигать трех миллионов человек.

9 августа, 19:34
Марк Чернов

Американская компания Firebird официально запустила в городе Раздан крупный центр обработки данных и фабрику искусственного интеллекта. На сегодняшний день это самый масштабный технологический хаб подобного уровня в СНГ, а после завершения всех этапов строительства он войдет в пятерку самых мощных вычислительных кластеров в мире.

19 июля, 20:09
Александр Березин

Очереди на заправках стали привычным явлением в России, а на фоне информационного вакуума от властей о конкретных показателях производства бензина в июне население вынуждено ориентироваться на слухи. Все это выглядит довольно странно, но есть нюанс: скорее всего, кризис уже начинает выдыхаться. Как именно мы это выяснили?

[miniorange_social_login]