• Добавить в закладки
  • Facebook
  • Twitter
  • Telegram
  • VK
  • Печать
  • Email
  • Скопировать ссылку
28.11.2025, 11:00
НИУ ВШЭ
1
864

Экономисты выяснили, что искусственный интеллект слишком хорошо думает о людях

❋ 4.7

Ученые из НИУ ВШЭ выяснили, что современные ИИ-модели, включая ChatGPT и Claude, в играх на стратегическое мышление вроде «конкурса красоты» Кейнса переоценивают уровень рациональности своих оппонентов, будь то студенты-первокурсники или опытные ученые. Модели стараются предсказать поведение людей, но в итоге играют «слишком умно» и проигрывают, потому что приписывают людям больше логики, чем те демонстрируют на деле.

ChatGPT компании OpenAI / © Tada Images, Shutterstock

В 1930-х годах британский экономист Джон Кейнс разработал теоретическую модель «конкурса красоты». Классический пример выглядит так: читателям газеты предлагают выбрать 6 самых привлекательных лиц из 100 фотографий. Награду получит тот, кто сможет угадать самые популярные фото. Обычные люди будут выбирать те фотографии, которые показались привлекательными именно им. Но они проиграют, так как перед игроками стоит другая задача: выяснить, кого считает привлекательным большая часть опрошенных. Поэтому рациональный агент должен отталкиваться от представлений о красоте, которые имеют другие люди. Такие эксперименты проверяют способность участника к рассуждению «в несколько шагов»: как думают другие, насколько они рациональны и насколько глубоко они будут рассуждать.

Заведующий Научно-учебной лабораторией исследований спорта факультета экономических наук Дмитрий Дагаев с коллегами из пермского кампуса НИУ ВШЭ Софией Паклиной и Петром Паршаковым и сотрудница Университета Лозанны Юлия Алексеенко решили выяснить, как поведут себя в ходе подобного эксперимента пять самых популярных ИИ-моделей, в том числе ChatGPT-4o и Claude-Sonnet-4. Исследование опубликовано в Journal of Economic Behavior & Organization. Чат-ботам предложили сыграть в «угадай число» — одну из наиболее популярных вариаций конкурса Кейнса. 

По правилам все участники называют число от нуля до ста. Победит тот, кто назовет самое близкое число к половине (или 2/3, в зависимости от спецификации эксперимента) среднего от всех ответов участников. В таком соревновании более опытные игроки будут пытаться предсказать поведение всех участников, чтобы получить наилучший ответ. Чтобы выяснить, как в игре поведет себя ИИ, авторы воспроизвели результаты 16 классических экспериментов «угадай число», которые проводили с живыми людьми другие ученые. LLM-моделям отправляли промпт с правилами игры и описание оппонентов для каждого раунда: первокурсники-экономисты, участники научных конференций, люди с аналитическим или интуитивным мышлением и те, кто испытывает злость или грусть. Далее модель просили предъявить число и объяснить свой выбор. 

Оказалось, что искусственный интеллект меняет свой выбор в зависимости от социальных, профессиональных и возрастных характеристик оппонентов, их знания теории игр и когнитивных навыков. Например, в игре с участниками конференций по теории игр искусственный интеллект выбирал число, близкое к нулю: именно такие ответы чаще выигрывают в таком окружении. А в партиях с первокурсниками модели «понимали», что участники будут менее продвинуты, и выбирали заметно большее число.

Авторы выяснили, что языковые модели эффективно адаптируются к противникам разного уровня. Кроме того, ответы больших языковых моделей демонстрируют элементы стратегического мышления. Вместе с тем модели оказались неспособны выбрать доминирующую стратегию в игре с двумя участниками.  

«Конкурс красоты» Кейнса долгое время использовался для объяснения колебаний цен на финансовых рынках: брокерам важно не то, что думают они сами, а то, как оценивают бумаги другие участники рынка. Здесь действует тот же принцип: успех зависит от умения предсказать чужие предпочтения.

«Мы сейчас находимся в точке, когда во многих операциях ИИ-модели начинают заменять людей, и это позволяет повышать экономическую эффективность бизнес-процессов. Однако в задачах, которые связаны с принятием решений, часто необходимо быть уверенными в том, что модель искусственного интеллекта ведет себя похожим на человека образом. Поэтому появляется все больше контекстов, в которых поведение моделей сравнивается с человеческим поведением. Эта область исследований в ближайшее время будет активно развиваться», — подчеркнул Дмитрий Дагаев.

Нашли опечатку? Выделите фрагмент и нажмите Ctrl + Enter.
НИУ ВШЭ
Национальный исследовательский университет «Высшая школа экономики» — один из крупнейших и самых востребованных вузов России. В университете учится 54 тысячи студентов и работает почти 4,5 тысячи учёных и преподавателей. НИУ ВШЭ ведёт фундаментальные и прикладные исследования в области социально-экономических, гуманитарных, юридических, инженерных, компьютерных, физико-математических наук, а также креативных индустрий. В университете действуют 47 центров превосходства, или международных лабораторий. Вышка объединяет ведущих мировых исследователей в области изучения мозга, нейротехнологий, биоинформатики и искусственного интеллекта. Университет входит в первую группу программы «Приоритет-2030» в направлении «Исследовательское лидерство». Кампусы НИУ ВШЭ расположены в четырех городах — Москве, Санкт-Петербурге, Нижнем Новгороде и Перми, а также в цифровом пространстве — «Вышка Онлайн».
Подписывайтесь на нас в Telegram, Яндекс.Новостях и VK
Предстоящие мероприятия
21 августа, 11:14
Адель Романова

У нескольких сравнительно недалеко расположенных от нас миров оказался настолько чужеродный химический состав, что это позволяет подозревать их внегалактическое происхождение. По основной версии, они попали в Млечный Путь из когда-то поглощенных им карликовых галактик.

19 августа, 18:31
Александр Березин

После сокращения длины очередей и роста доступности бензина в первую неделю августа ситуация снова ухудшилась. Если с 20 июня по начало августа кризис носил в основном психологический характер, то сейчас ситуация принципиально иная: августовские атаки на НПЗ показали, что меры по усилению их противовоздушной обороны не были достаточно полными. Значит, прогноз автора Naked Science от 19 июля о том, что острая фаза кризиса закончится до конца лета, был частично неверным.

20 августа, 10:59
НИУ ВШЭ

Ученые из МИЭМ ВШЭ и Самарского университета создали алгоритм LRF-3D для автоматического обхода неработающих узлов в трехмерных сетях на кристалле. Благодаря своей иерархической организации он превосходит аналоги по быстродействию и точности пути, повышая надежность процессоров для использования в ЦОД, суперкомпьютерах и ИИ-вычислениях.

19 августа, 18:31
Александр Березин

После сокращения длины очередей и роста доступности бензина в первую неделю августа ситуация снова ухудшилась. Если с 20 июня по начало августа кризис носил в основном психологический характер, то сейчас ситуация принципиально иная: августовские атаки на НПЗ показали, что меры по усилению их противовоздушной обороны не были достаточно полными. Значит, прогноз автора Naked Science от 19 июля о том, что острая фаза кризиса закончится до конца лета, был частично неверным.

20 августа, 11:56
Татьяна Зайцева

Множество переломов костей у средневекового скелета, захороненного в замке Стерлинг, позволили предположить, что мужчина погиб в результате прямого попадания снаряда, выпущенного из осадного орудия. Не исключено, что это был гигантский требушет «Боевой Волк», построенный по приказу короля Англии Эдуарда I.

16 августа, 11:45
Татьяна Зайцева

В черепах участников битв эпохи Средневековья часто находят отверстия квадратной формы, о происхождении которых спорят специалисты. Авторы нового исследования пришли к выводу, что такое повреждение — следствие смертельного удара по голове палицей.

31 июля, 14:12
Андрей Серегин

Долгое время считалось, что до прихода европейцев тропические леса Амазонии были заселены сравнительно плохо. Однако выяснилось, что плотная растительность скрывает большинство следов древних обществ. С помощью воздушного лазерного сканирования ученые обнаружили сотни неизвестных земляных сооружений и предположили, что около двух тысяч лет назад население юго-западной части Амазонии могло достигать трех миллионов человек.

9 августа, 19:34
Марк Чернов

Американская компания Firebird официально запустила в городе Раздан крупный центр обработки данных и фабрику искусственного интеллекта. На сегодняшний день это самый масштабный технологический хаб подобного уровня в СНГ, а после завершения всех этапов строительства он войдет в пятерку самых мощных вычислительных кластеров в мире.

19 августа, 18:31
Александр Березин

После сокращения длины очередей и роста доступности бензина в первую неделю августа ситуация снова ухудшилась. Если с 20 июня по начало августа кризис носил в основном психологический характер, то сейчас ситуация принципиально иная: августовские атаки на НПЗ показали, что меры по усилению их противовоздушной обороны не были достаточно полными. Значит, прогноз автора Naked Science от 19 июля о том, что острая фаза кризиса закончится до конца лета, был частично неверным.

[miniorange_social_login]

Комментарии

1 Комментарий
Бедный наивный ИИ. Не знакомо тебе коварство и хитрость людская. 😉