• Добавить в закладки
  • Facebook
  • Twitter
  • Telegram
  • VK
  • Печать
  • Email
  • Скопировать ссылку

Этот пост добавлен читателем Naked Science в раздел «Сообщество». Узнайте как это сделать по ссылке.

GPT-4 приблизился к успешной сдаче теста Тьюринга

Новое исследование, проведенное Эялем Ахарони, доцентом факультета психологии штата Джорджия (США), подтвердило: когда людям показывают два ответа на этический вопрос, большинство из них считают, что ответ чат-бота лучше, чем ответ другого человека.

ChatGPT / © Open AI
ChatGPT / © Open AI

С целью проверить, как ИИ понимает вопросы морали, Ахарони разработал модифицированный тест Тюринга. Студентам и искусственному интеллекту задавали одни и те же этические вопросы, а затем представили их письменные ответы 299 взрослым американцам. Испытуемых попросили оценить эти ответы, однако они не знали, кто был источником — человек либо GPT-4, мультимодальная большая языковая модель, созданная компанией OpenAI.

В подавляющем большинстве случаев ответы, сгенерированные четвертой версией ChatGPT, получили более высокую оценку, чем человеческие.

«Примечательно, что люди оценили моральные рассуждения ИИ как превосходящие человеческие почти по всем параметрам, включая добродетель, интеллект и надежность. Затем, когда участников попросили назвать источник каждой оценки (человек или компьютер), результаты оказались значительно выше случайных уровней. Хотя ИИ не прошел испытание, это случилось не из-за его неполноценных моральных рассуждений, а, возможно, из-за его предполагаемого превосходства», — отметили авторы научной работы, опубликованной в журнале Scientific Reports.

Результаты исследования, по словам Ахарони, предполагают, что GPT-4 технически может пройти моральный тест Тьюринга. Его стандартная интерпретация звучит следующим образом: человек, взаимодействуя с компьютером и человеком, на основании ответов на вопросы должен определить, с кем он разговаривает.

Подписывайтесь на нас в Telegram, Яндекс.Новостях и VK

Комментарии

4 Комментария
Я боюсь не той машины, которая пройдёт тест Тьюринга, а той, которая специально его завалит (С)
ChatGPT 4 фигня. Вот ChatGPT 5 будет бомба. Было интервью с создателем.
Предстоящие мероприятия
12 августа, 20:52
Марк Чернов

Качественное дошкольное образование закладывает прочный фундамент успехов на долгие годы вперёд — вплоть до выпускного класса. Двадцатилетнее исследование показало, что дети, которые в возрасте четырех лет перед поступлением в школу посещали бесплатные государственные подготовительные классы, учатся существенно лучше сверстников, посещавших обычные детские сады с упором на простой присмотр или оставшихся на домашнем воспитании.

13 августа, 15:29
Татьяна Зайцева

Молодая женщина, возвращения которой из мертвых местное общество, по-видимому, сильно опасалось, имела скандинавские корни и поэтому могла считаться чужестранкой, предположили авторы нового исследования. Ученые также смогли установить много других интересных подробностей о жизни и смерти девушки.

12 августа, 14:39
Илья Гриднев

Эксперимент физиков из ЦЕРН позволил рассмотреть поведение глюонов внутри атомных ядер с беспрецедентной точностью. При сверхвысоких плотностях эти элементарные частицы переставали размножаться и начинали объединяться. Это помогло найти подтверждение теории «глюонного насыщения», а не принятого «ядерного затенения» для определенного диапазона сверхвысоких энергий.

9 августа, 19:34
Марк Чернов

Американская компания Firebird официально запустила в городе Раздан крупный центр обработки данных и фабрику искусственного интеллекта. На сегодняшний день это самый масштабный технологический хаб подобного уровня в СНГ, а после завершения всех этапов строительства он войдет в пятерку самых мощных вычислительных кластеров в мире.

12 августа, 14:39
Илья Гриднев

Эксперимент физиков из ЦЕРН позволил рассмотреть поведение глюонов внутри атомных ядер с беспрецедентной точностью. При сверхвысоких плотностях эти элементарные частицы переставали размножаться и начинали объединяться. Это помогло найти подтверждение теории «глюонного насыщения», а не принятого «ядерного затенения» для определенного диапазона сверхвысоких энергий.

11 августа, 12:44
МАИ

Со стороны профессия летчика-испытателя часто выглядит как череда опасных полетов, требующих бесстрашия и способности мгновенно импровизировать. В действительности ее основу составляют методика, дисциплина, технические знания и умение честно рассказать о каждой особенности машины. Его задача — не просто поднять самолет в воздух, но и понять, насколько точно он выполняет команды, предсказуемо ли ведет себя на сложных режимах и какие изменения необходимо внести в конструкцию или систему управления.

31 июля, 14:12
Андрей Серегин

Долгое время считалось, что до прихода европейцев тропические леса Амазонии были заселены сравнительно плохо. Однако выяснилось, что плотная растительность скрывает большинство следов древних обществ. С помощью воздушного лазерного сканирования ученые обнаружили сотни неизвестных земляных сооружений и предположили, что около двух тысяч лет назад население юго-западной части Амазонии могло достигать трех миллионов человек.

9 августа, 19:34
Марк Чернов

Американская компания Firebird официально запустила в городе Раздан крупный центр обработки данных и фабрику искусственного интеллекта. На сегодняшний день это самый масштабный технологический хаб подобного уровня в СНГ, а после завершения всех этапов строительства он войдет в пятерку самых мощных вычислительных кластеров в мире.

19 июля, 20:09
Александр Березин

Очереди на заправках стали привычным явлением в России, а на фоне информационного вакуума от властей о конкретных показателях производства бензина в июне население вынуждено ориентироваться на слухи. Все это выглядит довольно странно, но есть нюанс: скорее всего, кризис уже начинает выдыхаться. Как именно мы это выяснили?

[miniorange_social_login]