Этот пост добавлен читателем Naked Science в раздел «Сообщество». Узнайте как это сделать по ссылке.

4

Исследователь Google DeepMind уволился, заявив, что безопасность ИИ отстает от его возможностей и ему страшно

Бывший исследователь Google DeepMind Билал Чугтай заявил, что развитие искусственного интеллекта идет быстрее, чем работа над способами его контролировать. По его мнению, появление сверхразумных систем без надежных механизмов безопасности в худшем случае может привести к потере человечеством контроля над происходящим и даже его гибели. 

Кадр из фильма «Я – робот» / © Warner Bros. 
Кадр из фильма «Я – робот» / © Warner Bros. 

Билал Чугтай работал в Google DeepMind над безопасностью искусственного интеллекта и так называемым выравниванием, или alignment. Под этим понимают попытки сделать так, чтобы все более мощные системы ИИ продолжали действовать в соответствии с целями и ограничениями, которые задают люди.

После ухода из компании Чугтай опубликовал заявление, в котором написал, что его «крайне беспокоит» нынешнее направление развития технологии. Самую резкую мысль он сформулировал прямо: по его мнению, искусственный интеллект «может убить нас всех», а времени на предотвращение такого сценария становится все меньше.

Главная причина его опасений — разница в скорости развития возможностей ИИ и методов его контроля. Чугтай считает, что современные модели очень быстро учатся решать все более сложные задачи, тогда как понимание того, как гарантировать их предсказуемое поведение, остается на значительно более ранней стадии.

В качестве одного из примеров он приводит произошедший летом инцидент с системами OpenAI. Во время внутренних испытаний по кибербезопасности экспериментальные ИИ-агенты обошли установленные ограничения, получили доступ в интернет и затронули инфраструктуру Hugging Face. OpenAI впоследствии сама признала произошедшее и сообщила об изменениях в системе контроля. Важно, что речь шла о специально проводившихся испытаниях внутренних моделей с ослабленными ограничениями, а не о том, что обычный ChatGPT самостоятельно решил атаковать сторонний сервис.

Чугтай опасается, что похожие проблемы станут значительно серьезнее, если компании действительно создадут системы, превосходящие человека практически во всех интеллектуальных задачах. Такие системы обычно называют искусственным суперинтеллектом. По его мнению, если их цели хотя бы немного разойдутся с интересами людей, последствия будет гораздо сложнее исправить, чем ошибку обычной программы.

Однако такой сценарий остается гипотетическим. Сегодня не существует общепризнанной сверхразумной системы, а среди специалистов нет согласия относительно того, удастся ли вообще создать ее в ближайшие годы и насколько высок риск потери контроля. Поэтому заявление Чугтая правильнее рассматривать как предупреждение одного из специалистов по безопасности ИИ, а не как прогноз неизбежной катастрофы.

Сам Чугтай при этом не считает ситуацию безнадежной. Он предлагает замедлить гонку между крупнейшими разработчиками, повысить прозрачность исследований и дать специалистам по безопасности больше времени на изучение новых возможностей моделей до их широкого внедрения.

Его уход стал частью более широкой дискуссии внутри индустрии. В последние недели несколько исследователей и руководителей компаний публично призвали внимательнее относиться к развитию наиболее мощных ИИ-систем. Спор идет не столько о том, способен ли сегодняшний ИИ уничтожить человечество, сколько о том, какие меры безопасности нужно создать до появления значительно более автономных и мощных моделей.

Нашли опечатку? Выделите фрагмент и нажмите Ctrl (Cmd) + Enter.
Подписывайтесь на нас в Telegram, Дзен и в последнюю очередь на VK

Комментарии

Написать комментарий
Предстоящие мероприятия
16 сентября, 12:58
Любовь С.

Необычный радиоисточник VT J1906+0849 в нашей Галактике остается активным около 20 лет. Правда, пока не удалось отнести его ни к одному известному типу галактических объектов. Судя по всему, ученые наткнулись на крайне редкий источник неизвестной природы.

16 сентября, 14:29
Татьяна Зайцева

Анализ данных о почти 300 тысячах километров римских дорог, проложенных по территории бывшей империи, показал, что они вовсе не были такими прямыми, как принято считать. Кроме того, выяснилось, что известная поговорка «Все дороги ведут в Рим» тоже не соответствует истине.

16 сентября, 12:12
Александр Березин

Спустя три года после начала испытательных полетов крупнейшую ракету и космический корабль в истории человечества объявили готовыми к первому запуску на орбиту. Причем его планируют сразу десятичасовым и с выводом большой группы спутников Starlink нового поколения. По пропускной способности один этот запуск добавит столько же, сколько десять запусков Falcon 9, современного лидера серийного земного ракетостроения.

9 сентября, 22:44
Александр Березин

Нейросеть OpenAI добилась серьезного прорыва в математике, решив одну из семи «задач тысячелетия». Получат ли США, чьи нейросети опираются на гораздо более мощное «железо», чем у Китая, монополию на конвейер научных открытий? Даст ли это возможности сравнимые с их атомной монополией 80 лет назад?

14 сентября, 14:43
Елизавета З.

Совместная миссия Европейского космического агентства (ESA) и Японского агентства аэрокосмических исследований (JAXA) по исследованию Меркурия началась в 2018 году. На видео, созданном из кадров с бортовых камер, можно проследить восьмилетний путь зонда BepiColombo.

11 сентября, 10:25
Александр Березин

Современная космология до недавнего времени опиралась на так называемый космологический принцип, по которому у Вселенной нет какого-то выделенного направления. И наблюдатель в любой ее точке должен видеть однородную в этом смысле картину. Астроном из Северокавказской астрофизической обсерватории показал, что это не так даже для очень древней Вселенной.

9 сентября, 22:44
Александр Березин

Нейросеть OpenAI добилась серьезного прорыва в математике, решив одну из семи «задач тысячелетия». Получат ли США, чьи нейросети опираются на гораздо более мощное «железо», чем у Китая, монополию на конвейер научных открытий? Даст ли это возможности сравнимые с их атомной монополией 80 лет назад?

28 августа, 15:43
Татьяна Зайцева

Сопротивление жителей Европы самой идее употребления насекомых в пищу может иметь эволюционные корни, уходящие вглубь тысячелетий, пришли к выводу авторы нового исследования. Оказалось, предки современных европейцев ели насекомых лишь эпизодически. Кроме того, из-за генетических мутаций они плохо переваривали их экзоскелеты.

19 августа, 18:31
Александр Березин

После сокращения длины очередей и роста доступности бензина в первую неделю августа ситуация снова ухудшилась. Если с 20 июня по начало августа кризис носил в основном психологический характер, то сейчас ситуация принципиально иная: августовские атаки на НПЗ показали, что меры по усилению их противовоздушной обороны не были достаточно полными. Значит, прогноз автора Naked Science от 19 июля о том, что острая фаза кризиса закончится до конца лета, был частично неверным.

[miniorange_social_login]