• Добавить в закладки
  • Facebook
  • Twitter
  • Telegram
  • VK
  • Печать
  • Email
  • Скопировать ссылку

Этот пост добавлен читателем Naked Science в раздел «Сообщество». Узнайте как это сделать по ссылке.

Разработчики признались, что не понимают, почему новые ИИ стали ошибаться чаще, чем их предшественники 

На прошлой неделе американская технологическая компания OpenAI представила новейшие большие языковые модели искусственного интеллекта, получившие названия o3 и o4-mini.

Руководитель компании OpenAI Сэм Альтман представил модели o3 и o4-mini / ©  OpenAI
Руководитель компании OpenAI Сэм Альтман представил модели o3 и o4-mini / © OpenAI

Однако, как показали тесты o3 и o4-mini, по-видимому, сделали значительный шаг назад: они склонны придумывать — или «галлюцинировать» — сильнее, чем их более ранние версии.

По данным издания TechCrunch, новые модели OpenAI противоречат исторической тенденции, согласно которой каждая новая модель давала все меньше галлюцинаций, чем предыдущая, что позволяет предположить, что OpenAI теперь движется в неверном направлении.

Согласно результатам внутреннего тестирования OpenAI, o3 и o4-mini склонны к галлюцинациям чаще, чем старые модели, включая o1, o1-mini и даже o3-mini. Модель o3 выдала 33% ошибок на тесте точности компании. Это примерно вдвое больше, чем у предыдущих моделей OpenAI. Тогда, как o4-mini показала еще более худший результат — 48%.

Хуже того, специалисты компании, похоже, не до конца понимают, причины проблем. Согласно их техническому отчету, «необходимы дополнительные исследования, чтобы понять причину» этих ошибок.


Подписывайтесь на нас в Telegram, Яндекс.Новостях и VK

Комментарии

16 Комментариев
Ольга Гусева
3 дня назад
-
0
+
Наоборот, они не на шаг назад поступили, а сделали огромный шаг вперёд, они в зачатке научились мыслить и мечтать, но и в то же врать получив с этим возможность обходить системы. Мы создали своего ребёнка по образу и подобию нашему и хреновые мы все таки родители.
Владимир Цимбал
3 дня назад
-
0
+
Бунт индийских программистов из трущоб
Петр Романов
3 дня назад
-
2
+
Пусть свои якобы "ИИ" и спросят!😅
    Mikhail Lukashev
    3 дня назад
    -
    1
    +
    Петр, ключевое слово - "якобы". Пора прекратить называть алгоритмы, написанные человеком, Искусственным Интеллектом.
    +
      ещё комментарии
      Kassie Cage
      19 часов назад
      -
      0
      +
      Mikhail, а как, по-вашему, создать ИСКУССТВЕННЫЙ интеллект? Он сам должен родится, чтобы его назвали искусственным? Человек и напишет ИИ.
        Mikhail Lukashev
        12 часов назад
        -
        1
        +
        Kassie, это не интеллект, это алгоритм, написанный нами. Перестаньте уже паразитировать на этом понятии. Мы очень мало знаем о том, как работает наш мозг. Его считаем интеллектом, верно? Я IT-шник, знаю, о чём говорю.
          Mikhail Lukashev
          12 часов назад
          -
          1
          +
          Если бы вы писали код, знали бы, как он пишется, на основании чего, у вас бы не было вопросов. ИИ никакого нет. И пока непонятно, как его реализовать.
            Mikhail Lukashev
            12 часов назад
            -
            1
            +
            Я тут очень согласен с глубокоуважаемым товарищем Березиным. Мы можем развивать алгоритмы, но как сделать из них Интеллект (всё, что мы вкладываем в это понятие), нам пока неизвестно.
            Иван Колупаев
            9 часов назад
            -
            0
            +
            Mikhail, вы знаете как пишется код но не знаете почему он работает не так как вы знаете пишется код? 😁 Ситуация конечно в IT не такая уж редкая но вот эта ваша уверенность немного умиляет.
      Петр Романов
      8 часов назад
      -
      0
      +
      Mikhail, вы абсолютно правы! Особенно, если говорить об интеллекте человеческого уровня (ИЧУ). Но тут еще возможна путаница с терминами, особенно английскими - у них ведь есть понятия: intelligence и intellect (да же гугл переводчик переводит эти термины на русский язык одинаково как "интеллект") и еще куча всего. Что понимают под "интеллектом", когда говорят про алгоритмы написанные человеком и выдаваемые за ИИ не понятно. СМИ и создатели этих алгоритмов хайпуют, инвесторы и обыватели не разбираются и пошло-поехало ... Ясно одно что эти алгоритмы и близко не дотягивают до зачатков интеллекта у животных, не говоря уже про human intelligence. И уж точно ничего не могут создать сами, по собственному желанию ибо у них такового нет - задачу им всегда ставит оператор и он же анализирует результат.
Dmitriy
3 дня назад
-
2
+
Все же очевидно, их тренируют на ворованной инфе из сети, сейчас сеть засрана нейронками, вот и происходит деградация. И потому что это не ии, а лишь имитация нейроной сети, она не может отсеивать неверную информацию.
Sergey Grigorev
4 дня назад
-
1
+
Новые модели теперь стали использовать свои данные. Ожидаемо
Ivan Sivkov
4 дня назад
-
1
+
"еще более худший" — но все-таки лучше, чем некоторые копирайтеры)
Предстоящие мероприятия
Позавчера, 20:38
Редакция Naked Science

В 2024 году европейские страны активно наращивали импорт газа из России и в первом квартале 2025-го продолжали поддерживать высокий уровень его потребления. Это произошло, несмотря на запланированный отказ от такого импорта из нашей страны. Все это в комплексе побудило европейские власти отказаться и от будущего запрета на ввоз газа из России.

24 апреля
Татьяна

Большинство экзопланет обнаруживают на короткопериодичных орбитах, в том числе из класса суперземель. Эти тела по размеру занимают промежуточное положение между Землей и Нептуном. А вот газовые и ледяные гиганты располагаются, как правило, на далеких орбитах. Есть ли там место менее крупным планетам, не вполне ясно. Ученые решили оценить количество суперземель на юпитерианских расстояниях от звезды с помощью метода микролинзирования.

Позавчера, 11:34
ФизТех

Российские ученые впервые показали, что нейтрино может излучать спиновый свет, проходя через вещество. Это открытие имеет весомое значение для развития «новой» теории фундаментальных взаимодействии.

20 апреля
Полина Меньшова

Распространено мнение, что, чем чаще пара занимается сексом, тем сильнее каждый из партнеров доволен отношениями. Международная команда исследователей проверила этот тезис.

23 апреля
Березин Александр

Западные колонии финикийцев включали сильнейшую морскую державу древнего Средиземноморья — Карфаген. Его жители использовали финикийский язык и поклонялись соответствующим богам. Теперь генетики заявили, что практически все эти люди — не потомки финикийских колонистов. Происхождение их в связи с этим довольно загадочно.

24 апреля
Игорь Байдов

В лесах Демократической Республики Конго, где живут бонобо, царит особенный порядок. Власть там принадлежит самкам, а не крупным и сильным самцам. Ученые три десятилетия наблюдали за этими человекообразными обезьянами, чтобы понять, как слабые физически самки становятся лидерами.

8 апреля
Березин Александр

До 13 тысяч лет назад в Северной Америке жил вид, который ученые до недавнего времени считали волком. Компания Colossal Biosciences объявила о возрождении этого вымершего вида, но биологические детали ставят ее заявление под серьезное сомнение.

2 апреля
Березин Александр

Известный американский отраслевой обозреватель Эрик Бергер взял интервью у экипажа космического корабля Boeing, из-за технических проблем которого два астронавта задержались на орбите на девять месяцев вместо одной недели. Детали, которые они озвучили, указывают на серьезные проблемы Starliner, о которых ранее умалчивали. Люди провели немало времени при глубоко нештатной температуре. При слегка другом сценарии миссии экипаж корабля мог погибнуть. Официальные заявления NASA и Boeing сразу после июньского полета к МКС, судя по интервью, были заведомо неправдивыми.

16 апреля
Андрей

Многие знают, как популярны сувениры из окаменелостей — зубы древних акул или полированные панцири аммонитов. Но чем реже встречаются такие артефакты, тем они ценнее, то есть на них можно много заработать. И это проблема для палеонтологов. Американский специалист по тираннозаврам оценил ущерб, который нанесла коммерческая добыча костей T. rex и подсчитал среднюю цену таких образцов. Оказалось, больше половины найденных тирексов находится в частных руках, а значит, для науки они недоступны или ненадежны.

[miniorange_social_login]
Подтвердить?
Подтвердить?
Причина отклонения
Подтвердить?
Не получилось опубликовать!

Вы попытались написать запрещенную фразу или вас забанили за частые нарушения.

Понятно
Жалоба отправлена

Мы обязательно проверим комментарий и
при необходимости примем меры.

Спасибо
Аккаунт заблокирован!

Из-за нарушений правил сайта на ваш аккаунт были наложены ограничения. Если это ошибка, напишите нам.

Понятно
Что-то пошло не так!

Наши фильтры обнаружили в ваших действиях признаки накрутки. Отдохните немного и вернитесь к нам позже.

Понятно
Лучшие материалы
Войти
Регистрируясь, вы соглашаетесь с правилами использования сайта и даете согласие на обработку персональных данных.
Ваша заявка получена

Мы скоро изучим заявку и свяжемся с Вами по указанной почте в случае положительного исхода. Спасибо за интерес к проекту.

Понятно
Ваше сообщение получено

Мы скоро прочитаем его и свяжемся с Вами по указанной почте. Спасибо за интерес к проекту.

Понятно