• Добавить в закладки
  • Facebook
  • Twitter
  • Telegram
  • VK
  • Печать
  • Email
  • Скопировать ссылку

Этот пост добавлен читателем Naked Science в раздел «Сообщество». Узнайте как это сделать по ссылке.

GPT-4 приблизился к успешной сдаче теста Тьюринга

Новое исследование, проведенное Эялем Ахарони, доцентом факультета психологии штата Джорджия (США), подтвердило: когда людям показывают два ответа на этический вопрос, большинство из них считают, что ответ чат-бота лучше, чем ответ другого человека.

ChatGPT / © Open AI
ChatGPT / © Open AI

С целью проверить, как ИИ понимает вопросы морали, Ахарони разработал модифицированный тест Тюринга. Студентам и искусственному интеллекту задавали одни и те же этические вопросы, а затем представили их письменные ответы 299 взрослым американцам. Испытуемых попросили оценить эти ответы, однако они не знали, кто был источником — человек либо GPT-4, мультимодальная большая языковая модель, созданная компанией OpenAI.

В подавляющем большинстве случаев ответы, сгенерированные четвертой версией ChatGPT, получили более высокую оценку, чем человеческие.

«Примечательно, что люди оценили моральные рассуждения ИИ как превосходящие человеческие почти по всем параметрам, включая добродетель, интеллект и надежность. Затем, когда участников попросили назвать источник каждой оценки (человек или компьютер), результаты оказались значительно выше случайных уровней. Хотя ИИ не прошел испытание, это случилось не из-за его неполноценных моральных рассуждений, а, возможно, из-за его предполагаемого превосходства», — отметили авторы научной работы, опубликованной в журнале Scientific Reports.

Результаты исследования, по словам Ахарони, предполагают, что GPT-4 технически может пройти моральный тест Тьюринга. Его стандартная интерпретация звучит следующим образом: человек, взаимодействуя с компьютером и человеком, на основании ответов на вопросы должен определить, с кем он разговаривает.

Подписывайтесь на нас в Telegram, Яндекс.Новостях и VK

Комментарии

4 Комментария
Я боюсь не той машины, которая пройдёт тест Тьюринга, а той, которая специально его завалит (С)
ChatGPT 4 фигня. Вот ChatGPT 5 будет бомба. Было интервью с создателем.
Предстоящие мероприятия
28 июля, 13:27
Александр Березин

Бывшие сотрудники NASA констатировали, что последнее видео испытаний крупнейшего космического корабля в истории снова показало проблемы и ограничения его теплового щита. С их точки зрения, любая из существующих технологий такого типа слишком сложна для реализации замысла Илона Маска о быстрой и безремонтной многоразовости Starship.

28 июля, 11:46
Редакция Naked Science

Правительство испанского автономного сообщества Арагон поддержало строительство гигафабрики по производству аккумуляторов в Фигеруэласе — совместный проект Stellantis и CATL. Решение завершило процесс согласования, открыв путь к реализации проекта TORO.

27 июля, 13:20
Александр Березин

Четыре точки Европы показали одну и ту же картину: как минимум несколько десятков тысяч лет регулярных сильных пожаров. До сих пор ученые не сталкивались с ископаемыми следами настолько длительных регулярных событий такого типа. Авторы новой работы предложили феномену объяснение, но оно имеет существенные недостатки.

28 июля, 13:27
Александр Березин

Бывшие сотрудники NASA констатировали, что последнее видео испытаний крупнейшего космического корабля в истории снова показало проблемы и ограничения его теплового щита. С их точки зрения, любая из существующих технологий такого типа слишком сложна для реализации замысла Илона Маска о быстрой и безремонтной многоразовости Starship.

24 июля, 11:13
Игорь Байдов

Правильно подобранные звуковые последовательности способны не только стимулировать рост растений, но и влиять на их урожайность. К такому выводу пришли авторы нового исследования. Они разработали технологию, которая позволяет воздействовать на процессы развития растений через акустические сигналы без использования генной инженерии или химикатов. В экспериментах добились повышения урожайности мяты, сои, болгарского перца и конопли.

28 июля, 10:09
ПНИПУ

Рост средней продолжительности жизни и старение населения формируют новые требования к системе государственного планирования. Для обоснованного распределения ресурсов в сфере здравоохранения, пенсионного обеспечения и социальной поддержки необходимы достоверные данные о возрастной структуре общества. Сегодня для этого применяют специальные математические модели, позволяющие прогнозировать изменения. Проблема в том, что их создавали еще в прошлом веке. Они не учитывают существующие демографические закономерности и улучшение качества современной жизни. Их использование часто ведет к значительным погрешностям в расчетах, что, в свою очередь, делает невозможным своевременное перераспределение бюджетных средств между ключевыми государственными структурами. Ученые Пермского Политеха предложили новую модель для прогнозирования продолжительности жизни, которая работает с точностью 99,7%. Ее можно применять для планирования в сфере здравоохранения, пенсионного обеспечения и социальной поддержки.

9 июля, 13:06
Редакция Naked Science

Видеосервисы стали неотъемлемой частью жизни россиян. В 2026 году охваты большинства платформ продолжают расти, в том числе YouTube.

19 июля, 20:09
Александр Березин

Очереди на заправках стали привычным явлением в России, а на фоне информационного вакуума от властей о конкретных показателях производства бензина в июне население вынуждено ориентироваться на слухи. Все это выглядит довольно странно, но есть нюанс: скорее всего, кризис уже начинает выдыхаться. Как именно мы это выяснили?

1 июля, 11:54
Марк Чернов

Древнеримские инженеры проложили колоссальную сеть дорог через Европу, Северную Африку и Ближний Восток, многие участки которой до сих пор поражают безупречной прямолинейностью. Секрет строительства заключался в использовании трех особых геодезических инструментов, с помощью которых разбивали местность на ровные отрезки и размечали трассы.

[miniorange_social_login]