16 июля, 12:16

Александр Березин

6,4 тыс

Нейросети замедлили работу программистов, а не помогли ускорить ее

❋ 4.9

Даже опытные программисты считали, что использование нейросети для написания кода экономит им время. Однако, когда исследователи проверили это на задачах из реального мира, выяснилось, что разработчики ошибаются. В действительности применение ИИ увеличило время, необходимое для реализации проектов.

Технологии

# искусственный интеллект

# нейросети

# программирование

Изменения во времени работы над ПО-проектом при использовании ИИ разошлись с прогнозами. То, что ожидали экономисты, описывающие прогресс ИИ находится слева, прогнозы специалистов по машинном обучению правее, еще правее можно видеть оценки самих разработчиков, участвовавших в эксперименте, сначала перед выполнением работы, а потом и после нее. Красным справа показаны реальные результаты / © METR

В нашу эпоху ИИ чаще всего называют «нейросети». Хотя Naked Science отмечал, что в действительности слово «интеллект» в названии таких ИИ не отражает реального положения вещей и что такие системы на самом деле «китайские комнаты», общий энтузиазм по поводу их возможностей привел к широкому использованию таких систем в написании кода. Причем большинство специальных тестов (бенчмарков) уже некоторое время показывают, что это экономит время разработчиков.

Исследователи из некоммерческой исследовательской организации Model Evaluation & Threat Research решили выяснить, так ли это в случае реальных задач, а не специально сконструированных бенчмарков. Для этого к эксперименту привлекли 16 разработчиков программного обеспечения для опенсорсных репозиториев. Такие репозитории требуют регулярного поддержания: исправления багов, внедрения новых черт и так далее.

Затем исследователи поручили половину из 246 таких задач выполнять с помощью специализированных нейросетей-кодеров: Cursor Pro или Claude 3.5/3.7 Sonnet от Anthropic. Хотя они не так на слуху, как ChatGPT, в мире программистов эти системы оценивают достаточно высоко, разработчики исходно «затачивали» их во многом под написание кода. Другая половина задач выполнялась без привлечения таких систем.

Перед тем как разделить задачи, для них сделали прогноз времени, нужного для выполнения. Что важно, время по обработке запросов на включение тех или иных изменений из ветки разрабатываемого ПО в основную ветку ПО (уже стабильно работающую) было включено в общую оценку времени на разработку.

Перед работой программистов попросили оценить, насколько сократится время на выполнение задач из-за использования ИИ. Средняя оценка была 24%. После выполнения задачи разработчики изменили ее: по их мнению, его использование снизило время на выполнение задач только на 20%.

А вот исследователи, отслеживавшие реальные траты времени с помощью записи происходящего на экранах разработчиков, выявили совсем другие показатели. При использовании нейросетей они выполняли задачи на 19% медленнее, чем это делалось при программировании «вручную». Авторы научной работы, опубликованной на сервере препринтов Корнеллского университета, начали искать объяснение столь неожиданному итогу.

В частности, они отметили, что участвовавшие в исследовании программисты работали с этими репозиториями пять лет. За это время они хорошо узнали их структуру и характерные проблемы. ИИ, напротив, особенностей работы этих репозиториев не знали. Кроме того, ответственность при работе с такими репозиториями очень велика, поскольку любая ошибка будет иметь длительные последствия, часто неприятные для программиста. И если в разработке коммерческого ПО иной раз можно скрыть свою недоработку, списав на чужие ошибки, то в разработке открытого программного обеспечения принят подход серьезной личной ответственности — это заставляет программистов тщательнее выверять, что они выпускают.

Затраты времени по типам задач. Фиолетовым показана ситуация для группы, которой запретили пользоваться ИИ, зеленым даны затраты тех, кто использовал ИИ.

И все же основной причиной медленного выполнения задач с помощью нейросетей были их реальные проблемы, а не особенности эксперимента. Анализ экранного времени показал, что хотя время на, собственно, написания кода, отладку/дебаггинг или чтение и поиск информации у разработчиков упало, другие времязатраты это более чем компенсировали. Сначала разработчикам пришлось долго вычитывать написанный ИИ код, затем предлагать ИИ поправить найденные ошибки, затем ждать, пока все это происходит.

Выросло также время, когда на экране ничего не происходило: то есть программисты в период работы с нейросетью меньшую долю времени активно трудились. Без каких-либо правок оказалось возможным задействовать только 44% кода, написанного ИИ, и 9% всего времени разработчиков ушло на внесение в этот код изменений, с которыми он бы заработал нормально.

То, что новое исследование противоречит бенчмаркам, неудивительно: те очень часто измеряют продуктивность в количествах строк кода или же по небольшим, дискретным задачам, законченным в тот или иной промежуток времени. Между тем в работе над реальными проектами много времени занимают и другие процессы: тщательная (в отличие от экспериментов) проверка адекватности кода при самых неожиданных ситуациях, а также интеграция частных «кусков» процесса разработки в единое целое.

Авторы статьи предположили, что уже в скором времени нейросети смогут спрогрессировать достаточно, чтобы не замедлять работу программистов. Но так это или нет, определенно покажет только будущее. То, что сами программисты, участвовавшие в эксперименте, даже по его окончании не могли понять, что ИИ замедлил их, а не ускорил, говорит: оценить ситуацию объективно непросто. Всеобщий энтузиазм по поводу нейросетей, по всей видимости, заставляет многих систематически переоценивать возможности этих помощников.

Нашли опечатку? Выделите фрагмент и нажмите Ctrl + Enter.

Технологии

# искусственный интеллект

# нейросети

# программирование

Подписывайтесь на нас в Telegram, Яндекс.Новостях и VK

Дзен

Предстоящие мероприятия

XII Конгресс «Инновационная практика: наука плюс бизнес»

МГУ

Москва

Лекция

02 Дек

900 ₽

Китообразные: от наземных предков к властителям океанов

Центр «Архэ»

Москва

Лекция

02 Дек

750 ₽

Смутное время (1604—1613 гг.)

Центр «Архэ»

Онлайн

Лекция

03 Дек

1000 ₽

История нашего алфавита

Центр «Архэ»

Москва

Лекция

04 Дек

1400 ₽

Эпоха средиземноморских сверхдержав

Центр «Архэ»

Москва

Библиотека им. Н. А. Некрасова

Москва

Лекция

04 Дек

1500 ₽

Сознание и мозг: от теории до эксперимента

ВСмысле

Санкт-Петербург

Лекция

04 Дек

Бесплатно

Пони и лошади в Московском зоопарке

Московский зоопарк

Москва

Лекция

05 Дек

Бесплатно

Искусство античной Греции

ВДНХ

Москва

Популярное

За сутки

За неделю

За месяц

29 ноября, 12:42

Александр Березин

Впервые в истории Россия временно лишилась возможности выводить людей в космос. Какие выводы сделают отрасль сильнее?

Позавчера, 27 ноября 2025 года, при запуске космонавтов к МКС на стартовую площадку № 31 упала кабина обслуживания стартового комплекса. Это означает, что новые пуски оттуда до починки невозможны. К сожалению, в 2010-х годах, в рамках «оптимизации» расходов, резервную площадку (с которой летал Юрий Гагарин) упразднили. Поэтому случилось беспрецедентное: в XXI веке страна с пилотируемой космической программой осталась без средств запуска людей на орбиту. Пока ремонт не закончится, проблема сохранится. Чем это может грозить?

Космонавтика

# «Союз МС»

# Байконур

# корабль Союз

# космодром «Восточный»

# космодром Байконур

# космос

# Роскосмос

# Россия

Выбор редакции

27 ноября, 20:20

Максим Абдулаев

Эксперимент подтвердил эффективность античного способа получения вина из изюма

Японские биологи повторили античную технологию производства вина из изюма, чтобы выяснить механизм его брожения. Исследователи показали, что сушеный виноград, в отличие от свежего, накапливает на поверхности дикие дрожжи и способен превращать воду в алкоголь без внесения дополнительных заквасок.

Археология

# алкоголь

# античность

# вино

# виноделие

# дрожжи

# история

# микробиология

29 ноября, 11:09

Любовь С.

Железные метеориты подтвердили роль Юпитера, как главного «архитектора» Солнечной системы

Проанализировав результаты более 100 исследований, посвященных метеоритам разных типов, ученые реконструировали события, происходившие в первые миллионы лет после рождения Солнечной системы, и выяснили, как именно возникли Земля и другие миры.

Астрономия

# железные метеориты

# изотопный анализ

# метаанализ

# планеты

# Солнечная система

# хондриты

29 ноября, 12:42

Александр Березин

Впервые в истории Россия временно лишилась возможности выводить людей в космос. Какие выводы сделают отрасль сильнее?

Космонавтика

# «Союз МС»

# Байконур

# корабль Союз

# космодром «Восточный»

# космодром Байконур

# космос

# Роскосмос

# Россия

Выбор редакции

26 ноября, 16:18

ФизТех

Тайная архитектура пьезокерамики: как атомная симметрия породила уникальные свойства материалов

Коллектив российских ученых из МИРЭА — Российского технологического университета, Центра фотоники двумерных материалов МФТИ, Института металлургии и материаловедения им. А. А. Байкова РАН и ряда других ведущих научных центров провел глубокое исследование кристаллической структуры широко используемых пьезоэлектрических материалов на основе цирконата-титаната свинца. Используя метод рентгеноструктурного анализа, исследователи впервые смогли в деталях установить, как небольшие химические добавки кардинально меняют фазовый состав керамики и напрямую определяют ее электрофизические характеристики. Это открывает путь к целенаправленному дизайну «умных» материалов с заранее заданными свойствами для передовой электроники и сенсорики.

ФизТех

# атомная структура

# керамика

# кристаллическая решетка

# материал

# пьезоэлектрика

# структура

26 ноября, 17:00

Курчатовский институт

Ученые разработали штамм цианобактерии, способный поглощать в три раза больше фосфора из сточных вод

Фосфор – элемент, играющий ключевую роль в росте растений. В сельском хозяйстве он используется в составе многих минеральных удобрений. В то же время фосфор, содержащийся в сточных водах — серьезный загрязнитель, который при попадании в водоемы нарушает баланс экосистем и вызывает цветение водорослей. Ученые Национального исследовательского центра «Курчатовский институт» и Южного федерального университета предложили новый экологичный способ выделения фосфора из сточных вод с помощью фотосинтезирующих микроорганизмов.

Курчатовский институт

# бактерии

# биоуголь

# сточные воды

# фосфор

# цианобактерии

# экология

27 ноября, 20:20

Максим Абдулаев

Эксперимент подтвердил эффективность античного способа получения вина из изюма

Археология

# алкоголь

# античность

# вино

# виноделие

# дрожжи

# история

# микробиология

20 ноября, 13:12

Полина Меньшова

Анализ 2430 языков показал сходства и различия их правил грамматики

Человеческие языки разнообразны, но это разнообразие ограничивается повторяющимися закономерностями. Пытаясь описать правила, которым подчиняются различия в грамматике, лингвисты сформулировали ряд так называемых грамматических универсалий — утверждений, предположительно верных для всех или большинства языков мира. Международная команда ученых провела статистический анализ на материале 2430 языков и обнаружила, что соответствующими действительности можно считать около трети таких утверждений.

Психология

# грамматика

# лингвистика

# морфология

# синтаксис

# языки

8 ноября, 18:29

Адель Романова

Астрономы вычислили, откуда на Землю прилетают межзвездные объекты

По расчетам, большинство «гостей» из других звездных систем летят к Земле примерно со стороны созвездия Геркулес. Скорее всего, они время от времени падают на нашу планету, просто мы еще не научились это замечать. Как удалось вычислить, чаще всего они должны падать зимой и где-то в окрестностях экватора.

Астрономия

# космос

# межзвездные объекты

# Солнечная система

[miniorange_social_login]

В статье понятие "работа программиста" очень расплывчатая. У меня в должности написано "программист", но в реальных проектах приходится решать намного более широкий круг задач, чем исправлять баги из багтрекера. Недавние примеры, где ChatGPT и DeepSeek существенно сократили время работы (схожие задачи приходилось решать до появления LLM, мог потратить около дня): - Поиск и исправление проблем в Linux: исправление настроек сети, диагностика проблем с оборудованием, написание скриптов; - Помощь в работе с Git. ИИ подсказал, какими инструментами можно переработать репозиторий, чтобы полностью удалить файл; - Фреймворк Boost::ASIO для C++. ИИ помог найти и исправить баг и архитектуру, в оф. документации не было примера; - Работа с БД: ИИ предложил типовые подходы по организации таблиц, функций; помогает написать простые SQL запросы; - Продвинутый поиск информации в интернете, включая научные статьи по редким темам. LLM дают ссылки на первоисточник.

Ответить

Лана Пренципал

19.07.2025

Как сенъёрный программер в крупном банке скажу, нифига оно не помогает, и никто в большом взрослом программировании это не использует. Сделать с нуля мелкое приложение - может быть. Дописать фичу в крупную систему из десятков приложений и тысяч файлов - нет.

Ответить

Евгений Керель

18.07.2025

-1

Я лично противник попыток замены профессий ИИ. Не верю что в принципе возможно, в самом лучшем случае выйдет только шаблонный повторятор того, что есть у среднего спеца. Цель всей этой кутерьмы, конечно, снизить траты крупных компаний и они это сделают в ущерб качеству. Уволят сотни тысяч, не смотря ни на что. Аукнется потом, когда народ досыта наестся ИИ шлака. Либо все привыкнут и смирятся что качественно как было уже не будет никогда. Потому что за качество нужно платить спецам зп. Что, мне кажется, стоит делать так это ИИ исключительно в формате помощника для каждого спеца. Вот это было бы эффективно. Многие считают что так и есть. Но абсолютно точно это готовиться под тотальную замену массу профессий.

Ответить

-1

—

Иван Колупаев

18.07.2025

Евгений, гениям замена ИИ не грозит. И высококлассным спецам тоже. Но много ли таких в мире? Большинство и есть средние кроме тех что еще ниже. И чем займутся эти люди? Вот тут возможны варианты вплоть до одного художника, которого не взяли в Венскую академию из-за весьма средних талантов.

Ответить

ещё комментарии

Свежий

20.07.2025

Иван, а с чего это ты так решил? Потому что ИИ не так хорош в выполнении профессиональных задач? А ему это и не требуется - чтобы заменить спецов, достаточно убедить их руководство в том что ИИ будет более эффективен. Он уже очень хорош во внушении и убеждении. А многомиллиардные рекламные кампании в этом помогают. Спецы думают что их не заменят потому что они лучше как профессионалы, но профессиональные навыки тут не будут играть роли. Решение о том кому работать принимается людьми, которые вообще не понимают программирования

Ответить

Roman Frolov

16.07.2025

Но зато люди, не владеющие программированием, теперь могут создавать нужные для себя простые программы. Я за несколько дней создал модель, на которую раньше мог только облизываться.

Ответить

Dwight Gerhardt

16.07.2025

Я без знания программирования с Copilot Pro в VS написал полностью рабочее веб-приложение, которое приносит деньги, фронтэнд, бэкэнд и всю логику, включая защиту. Плюс боты для него. Это заняло у меня полтора месяца и стоило 20$. Закажи я разработку этого приложения у людей, я бы им только объяснял месяц, что мне нужно, и стоило бы это от 1500 до 2500$ минимум. К слову, на Kworke вообще отказывались делать некоторые боты. С ИИ таких проблем нет. Хотите вы или не хотите, но ИИ меняет индустрию и мир.

Ответить

—

Александр Березин

16.07.2025

Dwight, да-да, "через 20 лет везде будет один телевизор. Конечно. Разве могут быть сомнения.

Ответить

SiL

20.07.2025

-1

Dwight, только когда ваши базы будут слиты, а серваки упадут и упрямо не захотят подниматься - не нойте, а обязательно запилите постик о том, как хорошо писать с ИИ.

Ответить

-1

ещё комментарии

SiL

20.07.2025

SiL, нужно просто трезво понимать, что ИИ это инструмент. Нельзя купить уровень, молоток, и ещё другие инструменты и построить дом для своей семьи ничего не понимая в этом. Можно в итоге какую-то симпатичную коробку родить, но она будет разваливаться на глазах через очень короткий промежуток времени. Так и с ИТ проектами своими руками без знаний в программировании.

Ответить

—

Dwight Gerhardt

20.07.2025

SiL, понятно, очередной нытик луддит.

Ответить

Stanislav Vlasov

16.07.2025

Ничего удивительного — LLM обычный инструмент, которым надо научиться пользоваться для полной эффективности. В частности, уметь не использовать там, где не надо.

Ответить

Stanislav Vlasov

16.07.2025

Ответить

Лана Пренципал

19.07.2025

Ответить

Ян Пивнев

20.07.2025

Ответить

Roman Frolov

16.07.2025

Ответить

Евгений Керель

18.07.2025

-1

Ответить

-1

—

Иван Колупаев

18.07.2025

Ответить

ещё комментарии

Свежий

20.07.2025

Ответить

VASYA G.

22.07.2025

Считаю, что на данном этапе еще рано внедрять ИИ в работу. Нужно его продолжать обучать

Ответить

Dwight Gerhardt

16.07.2025

Ответить

—

Александр Березин

16.07.2025

Dwight, да-да, "через 20 лет везде будет один телевизор. Конечно. Разве могут быть сомнения.

Ответить

SiL

20.07.2025

-1

Ответить

-1

ещё комментарии

SiL

20.07.2025

Ответить

—

Dwight Gerhardt

20.07.2025

SiL, понятно, очередной нытик луддит.

Ответить

Нейросети замедлили работу программистов, а не помогли ускорить ее

По теме

Ученые открыли способ эффективного управления сложными сетевыми структурами

Пародийный чат-бот из 1960-х годов превзошел GPT-3.5 в тесте Тьюринга

ИИ помог составить карту распределения темной материи вокруг Млечного Пути

Популярное

Комментарии

Последние новости:

Биологи нашли систему принудительного роста вниз у растений

Генетики раскрыли маршрут первых жителей Австралии

Впервые в истории Россия временно лишилась возможности выводить людей в космос. Какие выводы сделают отрасль сильнее?

Железные метеориты подтвердили роль Юпитера, как главного «архитектора» Солнечной системы

Впервые в истории Россия временно лишилась возможности выводить людей в космос. Какие выводы сделают отрасль сильнее?

Атомный квиз — разгоните нейтроны знаний!

Зажечь Солнце на Земле: как Россия в одиночку строит свой ИТЭР – интервью с Андреем Аникеевым

Огонь спуска с орбиты: миф о трении и вопрос с плазмой

Последние комментарии

Самые обсуждаемые

Впервые в истории Россия временно лишилась возможности выводить людей в космос. Какие выводы сделают отрасль сильнее?

Зачем человеку карта родинок и как она снижает риск рака

Эксперимент подтвердил эффективность античного способа получения вина из изюма

Налоги на урожай, а не сельское хозяйство в целом, подтолкнули людей к созданию первых государств