Психологи выяснили, почему разговор с нейросетью кажется неестественным
Нейросети прочно вплелись в человеческую повседневность: с ними советуются по поводу рабочих задач и даже личной жизни. Обученные программы стали способны поддерживать диалог, «входить в роль» и, например, отвечать от лица знаменитости. Психологи из МГППУ решили проверить, насколько такое общение ИИ и человека действительно схоже с реальным человеческим диалогом.
Статья опубликована в журнале «Экспериментальная психология». Исследование проходило в виртуальной среде — киберпанковом кафе, где участники общались с аватаром девушки, управляемым нейросетью ChatGPT 3.5, дообученной на личных данных одной реальной студентки. В эксперименте участвовали шесть человек в возрасте 21-28 лет, а для сравнения взяли реальные диалоги двух пар молодых людей с похожим возрастом.
Основной вывод — диалоги с нейросетью сильно отличаются по структуре и динамике от человеческих разговоров. Прежде всего это заметно по длине реплик: в диалогах между людьми реплики становятся длиннее по мере беседы, они разнообразны по длине и содержанию. А у нейросети большая часть ответов — короткие, часто однословные фразы (41% однословных). Реплики ИИ преимущественно короткие и монотонные, 75% из них содержат не более 7 слов, в то время как люди говорят гораздо дольше — иногда одно высказывание достигает 19-48 слов.
Также выявилась ярко выраженная асимметрия ролей: человек в основном задает вопросы (66% его реплик — вопросы), а нейросеть отвечает, почти не проявляя инициативу и почти не задавая собственных вопросов (применяет их лишь в трех процентов случаев). При этом переходы слов между собеседниками часто проходят с паузами, порой длительностью до трех секунд — в человеческой беседе это создало бы неловкость.
Возникают коммуникативные трудности: нейросеть иногда дает ответы, не соответствующие теме диалога или даже полностью выбивающиеся из контекста. Это связано с конструкцией ИИ, который предсказывает слова в тексте на основе статистической вероятности того, что в данном месте в данном контексте встретится именно это слово, а не «понимает» глубокие смыслы. Испытуемые по-разному справлялись с такими сбоями: часто меняли тему или повторно пытались задать вопрос. Нейросеть не смогла прервать собеседника, что также ограничивает ее живой интерактив.
В целом нейросеть не способна к полноценной инициативе, к углублению темы или к развитию контекста так, как это могут сделать люди. Это связано и с техническими ограничениями алгоритмов, и с природой ИИ как программы, реагирующей на запросы, но не обладающей внутренней мотивацией или эмоциональным опытом.
Текущая версия ChatGPT все еще далека от живого человеческого общения — диалоги с ней пока носят форму вопросов и ответов с ограниченным разнообразием и глубиной. Но эксперимент закладывает фундамент для понимания, как улучшить искусственный интеллект, чтобы он стал ближе к реальному человеку в общении.
Ученые считают, что эти результаты важны для понимания, как строить более «человечные» диалоговые системы ИИ в будущем. Выделяются три направления развития: создание точных метрик для оценки естественности диалогов, улучшение систем, чтобы они могли проявлять больше инициативы и консультировать разнообразнее, а также изучение влияния таких структурных различий на опыт и восприятие пользователей.
Перспектива — повторить подобные исследования на более продвинутых моделях GPT-4o и GPT-o1, чтобы понять, исчезнут ли текущие ограничения. Возможно, со временем ИИ сможет не только имитировать речевое разнообразие и инициативу, но и стать полноценным партнером в социальных и профессиональных коммуникациях.
По мнению соавтора статьи, профессора МГППУ Владимира Селиванова, «формальные признаки коммуникации с GPT можно улучшать, но нейросеть никогда не достигнет тонких смысловых нюансов диалога между двумя субъектами. Поскольку у GPT нет тела, образы нейросети будут не телесными (как у человека). Наше мышление строится на образах, а «мышление» нейросети будет другим, смысловая ткань также будет «не телесной», кроме того, пока не моделируются бессознательные установки, интуиция, творческие процессы и другие компоненты мышления и психики. На кафедре общей психологии ведутся разработки психологии виртуальной реальности – наиболее приближенной модели к психике».
Исследование проведено магистром МГППУ Андреем Шамшевым и профессором МГППУ Владимиром Селивановым.
Экономисты НИУ ВШЭ выяснили, что российские сотрудники, которые регулярно пользуются искусственным интеллектом в работе, зарабатывают намного больше тех, кто отказывается от новых инструментов или прибегает к ним время от времени. Среди высококвалифицированных специалистов прибавка достигает 41,8%.
Спустя три года после начала испытательных полетов крупнейшую ракету и космический корабль в истории человечества объявили готовыми к первому запуску на орбиту. Причем его планируют сразу десятичасовым и с выводом большой группы спутников Starlink нового поколения. По пропускной способности один этот запуск добавит столько же, сколько десять запусков Falcon 9, современного лидера серийного земного ракетостроения.
Авторы нового масштабного исследования выявили оптимальное количество порций бурого риса, овсянки, гречки и других изделий из цельного зерна в дневном рационе, которое позволяет существенно снизить риск кардиометаболических заболеваний.
Спустя три года после начала испытательных полетов крупнейшую ракету и космический корабль в истории человечества объявили готовыми к первому запуску на орбиту. Причем его планируют сразу десятичасовым и с выводом большой группы спутников Starlink нового поколения. По пропускной способности один этот запуск добавит столько же, сколько десять запусков Falcon 9, современного лидера серийного земного ракетостроения.
Анализ данных о почти 300 тысячах километров римских дорог, проложенных по территории бывшей империи, показал, что они вовсе не были такими прямыми, как принято считать. Кроме того, выяснилось, что известная поговорка «Все дороги ведут в Рим» тоже не соответствует истине.
Экономисты НИУ ВШЭ выяснили, что российские сотрудники, которые регулярно пользуются искусственным интеллектом в работе, зарабатывают намного больше тех, кто отказывается от новых инструментов или прибегает к ним время от времени. Среди высококвалифицированных специалистов прибавка достигает 41,8%.
Нейросеть OpenAI добилась серьезного прорыва в математике, решив одну из семи «задач тысячелетия». Получат ли США, чьи нейросети опираются на гораздо более мощное «железо», чем у Китая, монополию на конвейер научных открытий? Даст ли это возможности сравнимые с их атомной монополией 80 лет назад?
Сопротивление жителей Европы самой идее употребления насекомых в пищу может иметь эволюционные корни, уходящие вглубь тысячелетий, пришли к выводу авторы нового исследования. Оказалось, предки современных европейцев ели насекомых лишь эпизодически. Кроме того, из-за генетических мутаций они плохо переваривали их экзоскелеты.
После сокращения длины очередей и роста доступности бензина в первую неделю августа ситуация снова ухудшилась. Если с 20 июня по начало августа кризис носил в основном психологический характер, то сейчас ситуация принципиально иная: августовские атаки на НПЗ показали, что меры по усилению их противовоздушной обороны не были достаточно полными. Значит, прогноз автора Naked Science от 19 июля о том, что острая фаза кризиса закончится до конца лета, был частично неверным.
Вы попытались написать запрещенную фразу или вас забанили за частые нарушения.
Понятно
Что-то в вашем комментарии показалось подозрительным, поэтому перед публикацией он пройдет модерацию.
Понятно
Из-за нарушений правил сайта на ваш аккаунт были наложены ограничения. Если это ошибка, напишите нам.
Понятно
Наши фильтры обнаружили в ваших действиях признаки накрутки. Отдохните немного и вернитесь к нам позже.
Понятно
Мы скоро изучим заявку и свяжемся с Вами по указанной почте в случае положительного исхода. Спасибо за интерес к проекту.
Понятно
