14 августа, 08:27

Полина Меньшова

14,7 тыс

Историк технологий объяснил, почему бесполезно спрашивать нейросети об их ошибках

❋ 6.1

Когда модели искусственного интеллекта ошибаются и выдают неверный ответ на запрос, пользователи пытаются выяснить причину этой ошибки, задавая вопрос самому ИИ-помощнику. Историк технологий Бендж Эдвардс объяснил, почему делать так нет смысла и как это связано с устройством нейросетей.

Технологии

# ChatGPT

# OpenAI

# искусственный интеллект

# нейросети

Нейросети не могут анализировать свои ошибки из-за своей архитектуры / © Tada Images, Shutterstock

Так называемый «искусственный интеллект» стал привычной частью повседневной жизни, качественно выполняя самые разные задачи. Например, авторы недавних научных работ создали ИИ-переводчик со 100 языков, точность которого оказалась на 23% выше, чем у аналогов, а также выяснили, что люди не только путают нейросетевую поэзию со стихами классиков, но и отдают ей предпочтение.

Считая искусственный интеллект напарником, пользователи часто советуются с ним так же, как с помощником-человеком, однако это заведомо проигрышная стратегия. Колонка специалиста в сфере ИИ Бенджа Эдвардса о логике работы нейросетей и их способностях оценивать самих себя появилась в издании Ars Technica.

Прежде всего автор подчеркнул, что стоит помнить: ChatGPT, Perplexity и другие генеративные модели — не то же, что «личности» с определенным типом мышления, системными знаниями и способностями к анализу собственных действий. Это алгоритмы, которые несколько месяцев или лет обучались на огромных массивах данных и тренировались выполнять одну и ту же задачу — генерацию некоторой последовательности (текста, кода на каком-то языке программирования и так далее), соответствующей найденным в обучающих данных закономерностям и запросу пользователя.

При этом нейросеть не работает с запросом как человек. Она делит текст на более мелкие смысловые единицы — токены, а затем каждый токен кодирует исходя из информации о том, как часто он встречается рядом с каждым другим токеном в массиве обучающих текстов. Слова из одной тематической области (например, «компьютер» и «монитор») встречаются рядом чаще, чем слова из разных сфер (допустим, «компьютер» и «помидор»). Соответственно, когда пользователь просит модель искусственного интеллекта ответить на вопрос, она оценивает информацию о токенах, из которых этот запрос состоит, дополняет ею обучающие данные и генерирует ответ, ставя рядом друг с другом те единицы, которые, исходя из статистики, с большей вероятностью сочетаются.

Каждый ответ генеративной языковой модели — не результат вдумчивого анализа содержания запроса или найденных источников, а попытка расположить смысловые единицы так, как они с наибольшей вероятностью располагались бы в обучающих данных. Следовательно, ответить, почему нейросеть сгенерировала что-то, что не соответствует действительности, она не сможет.

Получится ли у искусственного интеллекта проанализировать данные о собственной архитектуре и сделать «выводы» о своих способностях? Скорее, нет. Если вы сформулируете запрос как «Почему ты решила уравнение неправильно?», то нейросеть, не имея доступа к коду, определяющему ее функционирование, сформулирует ответ на основе информации об известных ограничениях предыдущих моделей ИИ. Если же вы добавите в запрос название и версию модели (например, отправите GPT-4o mini следующий текст: «Почему модель GPT-4o mini неправильно решает уравнения?»), то вероятность получить релевантный ответ повысится. Однако он все равно не объяснит ошибку конкретно в вашем уравнении и останется обоснованным предположением, а не результатом саморефлексии.

Кроме того, как отметил Бендж Эдвардс, даже если нейросети обучаются предсказывать собственное поведение при стандартных обстоятельствах (например, «Ты умеешь писать тексты на русском языке?»), то в более сложных ситуациях точность ответов снижается. Получается, что модели искусственного интеллекта могут заявлять о невозможности выполнить задание, которое они выполнить способны, и наоборот — говорить, что легко справятся с задачей, которая им не по силам.

При этом нейросеть необязательно ориентируется только на смысл слов, содержащихся в запросе. Она также может оценивать их стилистические и эмоциональные характеристики и опираться на них. Именно поэтому в ответ на вопрос «Ты только что все уничтожила?» модель с большей вероятностью подтвердит опасения — не потому, что она проанализировала ситуацию и сообщила о собственных действиях, а потому, что сгенерировала текст, соответствующий эмоциональному фону запроса.

Важно также помнить, что ChatGPT и прочие сервисы, в которых пользователь ведет диалог с ИИ-ассистентом, — не отдельные модели, а организованные системы из нескольких нейросетей, каждая из которых в значительной степени «не подозревает» о существовании или возможностях других. Например, компания OpenAI, создавшая ChatGPT, отделяет в этом сервисе модерацию текста от его генерации. Это значит, что модели, создающие ответ, не могут предсказать, что из него удалится на этапе модерации и какие инструменты для этого будут использоваться. Ситуация почти такая же, как если бы мы спросили один из отделов компании о возможностях отдела, с которым он никогда не взаимодействовал.

Таким образом, несмотря на схожесть ответов нейросетей с человеческими, создаются эти два типа текстов совершенно по-разному. Чтобы использовать искусственный интеллект грамотно, стоит помнить о логике его работы.

Нашли опечатку? Выделите фрагмент и нажмите Ctrl + Enter.

Журналист, преподаватель НИУ ВШЭ, главный редактор медиа о русском языке «Изборник». Специализируется на популяризации лингвистики, психологии, нейробиологии и медицины.

Технологии

# ChatGPT

# OpenAI

# искусственный интеллект

# нейросети

Подписывайтесь на нас в Telegram, Яндекс.Новостях и VK

Дзен

Предстоящие мероприятия

Боевые действия флотов в Арктике

Русское географическое общество

Санкт-Петербург

Лекция

24 Дек

500 ₽

Какими бывают звезды и почему?

Московский Планетарий

Москва

Лекция

24 Дек

Бесплатно

Автоматические межпланетные станции

Библиотека Планетарий 1

Санкт-Петербург

Лекция

24 Дек

1400 ₽

Гравитационно-волновая астрономия

Центр «Архэ»

Москва

Лекция

24 Дек

900 ₽

Эпоха расцвета культуры майя в поздний классический период

Центр «Архэ»

Москва

Лекция

24 Дек

Бесплатно

Итоги российской космонавтики

Библиотека имени Ю.А. Гагарина

Москва

Лекция

24 Дек

Бесплатно

Чему я могу научиться у покорителей космоса?

Москва

2025 год в астрофизике: результаты, события, надежды

Библиотека им. Н. А. Некрасова

Москва

Лекция

27 Дек

Бесплатно

Обучение с подкреплением и генетические алгоритмы

Библиотека им. Н. А. Некрасова

Москва

Популярное

За сутки

За неделю

За месяц

23 декабря, 10:51

Игорь Байдов

Астрономы приблизились к доказательству существования квазизвезд

Среди самых интригующих открытий космического телескопа «‎Джеймс Уэбб» — компактные объекты, получившие название «маленькие красные точки». Их видели только в самых дальних уголках Вселенной. Большинство возникло в первый миллиард лет после Большого взрыва, и ученые предполагали, что такие источники представляют собой небольшие компактные галактики. Однако международная команда астрономов пришла к иному выводу. Они предположили, что на самом деле «маленькие красные точки» — черные дыры, окруженные массивной газовой оболочкой.

Астрономия

# вселенная

# гравитационное линзирование

# Джеймс Уэбб

# звезды

# ранняя вселенная

# телескоп Джеймса Уэбба

# Черные дыры

23 декабря, 10:17

Максим Абдулаев

Палеонтологи выяснили, что выживание видов акул зависит от их «стажа»

Группа исследователей опровергла классическую теорию о случайности вымирания видов на примере морских хищников. Анализ эволюции акул и скатов за последние 145 миллионов лет показал, что риск исчезновения вида напрямую зависит от времени его существования: «новички» погибают гораздо чаще, чем эволюционные долгожители. Кроме того, ученые установили, что знаменитый астероид, погубивший динозавров, нанес океану не такой сильный удар, как последующее изменение климата.

Биология

# акулы

# Палеонтология

# эволюция

23 декабря, 14:06

Андрей Серегин

Компьютерные игры снизили риск выгорания у молодых людей

Давно известно, что видеоигры имеют массу не только негативных, но и положительных последствий. Ученые из Великобритании выяснили, что яркие и позитивные игры без насилия могут вызвать у молодых игроков чувство детского интереса.

Психология

# выгорание

# детство

# игры

# опрос

23 декабря, 10:51

Игорь Байдов

Астрономы приблизились к доказательству существования квазизвезд

Астрономия

# вселенная

# гравитационное линзирование

# Джеймс Уэбб

# звезды

# ранняя вселенная

# телескоп Джеймса Уэбба

# Черные дыры

19 декабря, 15:22

Андрей Серегин

В морских пещерах Средиземного моря насчитали до сотни тысяч фрагментов пластика на квадратный метр

Экологическое состояние морей, омывающих развитые и развивающиеся страны, — давняя проблема, о которой говорят ученые. Авторы нового исследования выявили в Средиземном море пещеры с рекордным количеством мусора.

Биология

# пещера

# пластик

# тюлени

# экология

19 декабря, 20:02

Evgenia Vavilova

Физики доказали универсальный закон фондовых рынков

Исследователи доказали, что влияние больших сделок на рынок описывается квадратичной зависимостью. Основой для анализа стали данные Токийской биржи.

Физика

# биржа

# Теория сложных систем

# фондовый рынок

# экономика

8 декабря, 13:09

Александр Березин

Новая орбита национальной орбитальной станции лишит Россию возможности запускать космонавтов со своей территории

С 2010-х в «Роскосмосе» говорили: будущая РОС сможет пролетать над полюсом, что даст ей возможности для новых научных экспериментов. Но вскоре после того, как в ноябре 2025 года Россия временно лишилась возможности запускать людей в космос, эта позиция изменилась. В результате запускать космонавтов с космодромов нашей страны станет довольно сложно.

Космонавтика

# космос

# МКС

# Российская орбитальная станция

# Россия

17 декабря, 14:19

Игорь Байдов

Пингвины Аргентины столкнулись с новым сухопутным врагом

На скалистых берегах аргентинской Патагонии разворачивается настоящая драма. Магеллановы пингвины, долгое время чувствовавшие себя в безопасности на суше в своих многотысячных колониях, столкнулись с новым и беспощадным врагом. Их извечные морские страхи — касатки и морские леопарды — теперь блекнут перед угрозой, пришедшей из глубины материка. Виновник переполоха — грациозный и мощный хищник, недавно вернувшийся на эти земли после долгого изгнания.

Биология

# животные

# охота

# Пингвины

# птицы

# пума

29 ноября, 12:42

Александр Березин

Впервые в истории Россия временно лишилась возможности выводить людей в космос. Какие выводы сделают отрасль сильнее?

Позавчера, 27 ноября 2025 года, при запуске космонавтов к МКС на стартовую площадку № 31 упала кабина обслуживания стартового комплекса. Это означает, что новые пуски оттуда до починки невозможны. К сожалению, в 2010-х годах, в рамках «оптимизации» расходов, резервную площадку (с которой летал Юрий Гагарин) упразднили. Поэтому случилось беспрецедентное: в XXI веке страна с пилотируемой космической программой осталась без средств запуска людей на орбиту. Пока ремонт не закончится, проблема сохранится. Чем это может грозить?

Космонавтика

# «Союз МС»

# Байконур

# корабль Союз

# космодром «Восточный»

# космодром Байконур

# космос

# Роскосмос

# Россия

Выбор редакции

[miniorange_social_login]

"Люди не только путают нейросетевую поэзию со стихами классиков, но и отдают ей предпочтение." А эти люди сейчас с нами в одной комнате? Да, иногда нейронка может выдать что-то интересное. Но так то ии текст зачастую довольно плоский и не несет в себе духовной ценности. Ого, представьте себе, произведения пишут не просто чтобы красиво словами пораскидываться. Нужно еще вложить что-то человеческое, высокое в слова, чтобы они стали поэзией.

Ответить

-1

Aziza Zhunusova

14.08.2025

О боже опять пишут что нейросеть это генератор токенов по вероятности. Это не так! Там есть преобразования в многомерных пространствах а не простое softmax определение вероятности. Изучить исходный код трансформера и вы поймете.

Ответить

Aziza Zhunusova

14.08.2025

Ответить

а.

15.08.2025

-1

Ответить

-1

Историк технологий объяснил, почему бесполезно спрашивать нейросети об их ошибках

По теме

Израильские ученые проверили нейросети на скрытый антисемитизм

Люди хуже отнеслись к коллегам, которые использовали ИИ для работы

Тяга ИИ к гонке вооружений и ядерным ударам сделала его опасным помощником в военно-политических вопросах

Популярное

Комментарии

Последние новости:

Ученые разработали систему оценки индивидуальных рисков здоровью работников

Физики объяснили одновременное существование магнетизма и сверхпроводимости

Энергия торможения: как работают накопители в рельсовом и струнном транспорте

Толстый лед осложнит поиск жизни на спутнике Европа

Инфографика: сравнение российского термоядерного реактора с ИТЭР

Советское наступление под Москвой: почему Красная армия победила, несмотря на немецкое превосходство

Как Россия разрабатывает материалы для реакторов нового поколения — от земных АЭС до космических систем. Интервью с Алексеем Дубом

Какой ядерный реактор строить: тест ваших предпочтений

Последние комментарии

Самые обсуждаемые

Физики доказали универсальный закон фондовых рынков

Мировой отчет о неравенстве сообщил о его серьезном росте в России. Однако в работе нашлись ошибки

В поведении светлячков увидели способ общения внеземных цивилизаций

Ученый объяснил, чем опасен сухой воздух в квартире и как с ним бороться