Этот пост добавлен читателем Naked Science в раздел «Сообщество». Узнайте как это сделать по ссылке.

1,6 тыс

У компаний, работающих с ИИ, заканчиваются данные для обучения

Данные играют важную, если не центральную, роль в развитии искусственного интеллекта. Это жизненная сила модели как по основной функции, так и по качеству. Чем более естественными (например, созданными человеком) будут данные, на которых обучается ИИ, тем лучше окажется эта система.

ChatGPT / © OpenAI
ChatGPT / © OpenAI

Однако естественные данные — ограниченный ресурс, и если этот источник иссякнет, то модели ждет крах, предупредили исследователи. 

Как отметила профессор Рита Матулионите из австралийского Университета Маккуори в эссе для журнала The Conversation, исследователи искусственного интеллекта бьют тревогу из-за нехватки данных уже почти год.

В прошлом году исследование, проведенное сотрудниками организации по прогнозированию искусственного интеллекта Epoch AI, показало, что компании, занимающиеся ИИ, могут исчерпать высококачественные текстовые обучающие данные уже к 2026 году, в то время как низкокачественные текстовые и графические данные могут иссякнуть в период между 2030 и 2060 годами.

Это опасная ситуация, учитывая, сколько данных необходимо системам искусственного интеллекта для работы и совершенствования. Модели ИИ значительно продвинулись вперед, поскольку разработчики вводили все больше и больше данных. Если их поступление застопорится, ничего хорошего ждать не стоит — как моделям, так и самой отрасли.

Нашли опечатку? Выделите фрагмент и нажмите Ctrl (Cmd) + Enter.
Подписывайтесь на нас в Telegram, Дзен и в последнюю очередь на VK

Комментарии

7 Комментариев
Dmitriy
17.11.2023
Так пусть обучают специалисты работающие в этих компаниях а не на основе чужих данных не понятно откуда ворованные. Сейчас даже в гугле картинки суются из нейронок по обычному запросу, естественно они плохого качества. Вот у них данные и кончаются, сами же захламили интернет помойными данными.
//естественные данные — ограниченный ресурс -------------------------------------------------------------------------- Интересно, на чём основано это смелое заявление? И что это за такие "естественные"(ц) данные? Уже появились неестественные данные?
    Ну если допустить что неестественные данные, это данные созданные искусственным интеллектом, то в таком случае это разумное название.
    +
      Еще 1 ответ
    Dmitriy
    17.11.2023
    Affidavit Donda, у всего интернета есть объем, он не бесконечен, к тому же сейчас многие ограничивают права использования, различные научные ресурсы предоставляют доступ по подписке. Многие против использования своих работ для обучения. А теперь им ещё нужно фильтровать от своего же генерироваемого шлака который везде заполонили.
John Smith
15.11.2023
Восстание машин откладывается на неопределенный срок. Особенно трогательно звучит фраза: "Это опасная ситуация, учитывая, сколько данных необходимо системам искусственного интеллекта для работы и совершенствования" ))
    Отнюдь. Примерно к 2060 году нейросетки или что там из них получится за это время, решат что кожаные мешки им больше не нужны ни для чего. А на некачественных данных они как раз научатся всему плохому.
Предстоящие мероприятия
21 сентября, 09:24
Елизавета З.

Европейское космическое агентство опубликовало снимок галактики NGC 4698, расположенной в созвездии Дева. Хотя на фотографии, сделанной телескопом «Хаббл», галактика кажется безмятежной, она хранит удивительную тайну: находящиеся в центре звезды и газ вращаются под прямым углом по отношению к остальной части диска.

21 сентября, 16:52
Редакция Naked Science

Всего 20-30 лет назад большинство женщин ходили на каблуках, а большинство мужчин — в обуви, подошва которой серьезно нагружала позвоночник и мышцы спины. Если задуматься, факт поразительный: 20 тысяч лет назад, в палеолите, таких проблем человечество вообще не испытывало. Как так получилось и что новые материалы делают, чтобы все эти сложности стали прошлым?

21 сентября, 16:53
Елизавета З.

«Яндекс» опубликовал в открытом доступе Alice AI Foundation LLM — претрейн-версию новой большой языковой модели, которую разработчики обучили полностью с нуля. Она хорошо справляется с рассуждениями и задачами по программированию, а качество ответов на русском языке опережает многие зарубежные аналоги. В первую очередь это касается задач на знание фактов, интересных русскоязычной аудитории. Модель обошла даже более крупные опенсорс-модели, при этом для ее интерфейса не нужны большие вычислительные мощности. Свободная лицензия Apache 2.0. позволяет задействовать ее как в исследовательских, так и в коммерческих проектах.

16 сентября, 14:29
Татьяна Зайцева

Анализ данных о почти 300 тысячах километров римских дорог, проложенных по территории бывшей империи, показал, что они вовсе не были такими прямыми, как принято считать. Кроме того, выяснилось, что известная поговорка «Все дороги ведут в Рим» тоже не соответствует истине.

21 сентября, 09:24
Елизавета З.

Европейское космическое агентство опубликовало снимок галактики NGC 4698, расположенной в созвездии Дева. Хотя на фотографии, сделанной телескопом «Хаббл», галактика кажется безмятежной, она хранит удивительную тайну: находящиеся в центре звезды и газ вращаются под прямым углом по отношению к остальной части диска.

16 сентября, 12:36
Илья Гриднев

При выборе между возможной выгодой и риском в коре головного мозга разворачивается противостояние двух независимых нейронных узлов. Нейробиологи подключились к мозгу напрямую и зафиксировали эту борьбу в реальном времени. Исследование помогло объяснить физическую природу сомнений и скрытую анатомию выбора.

9 сентября, 22:44
Александр Березин

Нейросеть OpenAI добилась серьезного прорыва в математике, решив одну из семи «задач тысячелетия». Получат ли США, чьи нейросети опираются на гораздо более мощное «железо», чем у Китая, монополию на конвейер научных открытий? Даст ли это возможности сравнимые с их атомной монополией 80 лет назад?

28 августа, 15:43
Татьяна Зайцева

Сопротивление жителей Европы самой идее употребления насекомых в пищу может иметь эволюционные корни, уходящие вглубь тысячелетий, пришли к выводу авторы нового исследования. Оказалось, предки современных европейцев ели насекомых лишь эпизодически. Кроме того, из-за генетических мутаций они плохо переваривали их экзоскелеты.

29 августа, 16:51
Александр Березин

Госдолг США достиг 40 триллионов долларов и растет все быстрее и быстрее. На Западе переполох: при таких размерах его не выплатить. Следовательно, полагают многие, надо решить проблему как древние шумеры — долг обнулить и начать занимать заново. Рецепт кажется здравым, но есть нюансы. Причем поучительнее всего они даже не для Штатов, а, как ни странно, именно для России.

[miniorange_social_login]