• Добавить в закладки
  • Facebook
  • Twitter
  • Telegram
  • VK
  • Печать
  • Email
  • Скопировать ссылку
31.05.2019, 10:33
alex007
8
16,6 тыс

Искусственный интеллект DeepMind победил людей в кооперативной игре Quake III Arena

Агенты нейросети тренировались на тысячах игр одновременно, проведя около 450 тысяч матчей.

55
©Wikipedia / Автор: Sycophanta Duccius

Сотрудники британской компании DeepMind, которая с 2014 года принадлежит Google, опубликовали статью в журнале Science, посвященную успехам их искусственного интеллекта. На этот раз они смогли натренировать алгоритм на командную игру в режиме «Захват флага» мультиплеерного шутера Quake III Arena. Команда из агентов ИИ в подавляющем количестве игр победила команду людей.

 

Для тренировки агентов специалисты использовали обучение с подкреплением — метод машинного обучения, при котором система учится, взаимодействуя со средой. Авторы статьи пишут, что этот метод успешно зарекомендовал себя в обучении одного агента, но они хотели узнать, насколько он успешен при командной работе.

 

В качестве платформы они выбрали мультиплеерный шутер от первого лица Quake III Arena, но задали свои условия игры. Во-первых, карты каждый раз генерируются случайно. Во-вторых, в матче принимают участие только четыре игрока: по два с каждой стороны. Соревнование проходит только в одном режиме — «Захват флага»: каждая из команд должна одновременно защитить свой флаг, захватить флаг оппонентов и принести на свою базу. Реакцию системы снизили до средних показателей человека.

 

Авторы тренировали 30 агентов. Тренировка происходила благодаря многотысячным параллельным партиям, которые отыгрывали агенты. При этом каждый агент представлял собой индивидуальную единицу, которая действует самостоятельно, исходя из обучения с подкреплением. Специалисты также демонстрируют филогенетическое дерево, которое строится в ходе этого обучения.

 

Процесс обучения / ©Science

 

После тренировок алгоритмы сыграли несколько партий с командой людей. Обе команды играли на неизвестных для них картах. Пара агентов за игру в среднем захватывала на 16 флагов больше, чем пара людей. Только когда человек играл в партнерстве с искусственным интеллектом, ему удавалось выиграть у объединения алгоритмов (5% вероятности победы).

 

Профессор Технологического колледжа Джорджии Марк Ридл (Mark Riedl) раскритиковал такой подход британской фирмы, сказав, что агенты не обмениваются сообщениями, а лишь реагируют на те события, которые происходят в игре. Однако представитель DeepMind Макс Джадерберг (Max Jaderberg) возразил:

 

«[В нашей симуляции] один из агентов сидит в лагере противника, ожидая, когда вновь появится флаг, это возможно только потому, что он полагается на своего партнера по команде».

 

Джадерберг говорит об одной из тактик искусственного интеллекта, выработанной тем в ходе обучения, которая предполагает ожидание появления нового флага в лагере оппонента. Ее часто используют и люди.

 

В январе DeepMind сообщила, что ее искусственный интеллект AlphaStar одолел двух профессиональных игроков в стратегию StarCraft II, проходящую в реальном времени.

Нашли опечатку? Выделите фрагмент и нажмите Ctrl + Enter.
Подписывайтесь на нас в Telegram, Яндекс.Новостях и VK
Предстоящие мероприятия
11 мая, 06:54
Лена

Крупные травоядные утконосые майазавры известны своим развитым социальным поведением. Они жили семьями и строили гнезда для своих детенышей. Даже название вида переводится с греческого языка как «ящер — хорошая мать». Исследование окаменелых зубов майазавров показало, что они выращивали детенышей совсем не так, как это считалось типичным для животных глубокой древности.

10 мая, 10:49
Александр Березин

Десятого мая 1940 года вермахт пришел в движение. Через 42 суток англо-французские армии были разгромлены, а Франция капитулировала. Как это произошло, ведь союзники имели больше солдат, танков и пушек, чем немцы? В СССР причиной посчитали нежелание французов воевать, немцы же, говорили советские военные, не внесли в стратегию ничего нового. Реальность была строго обратной: разгром Франции был новым словом в войне, и такой же сценарий Гитлер применил против СССР через год. Что именно произошло и отчего советское руководство не смогло осознать случившееся?

12 мая, 11:21
Игорь Байдов

Римская империя господствовала в Британии на протяжении приблизительно четырех веков. За это время римляне сильно повлияли на местное население: строили города, внедряли новые законы, развивали торговлю и меняли образ жизни. Однако авторы нового исследования выяснили, что вопреки распространенному мнению, генетический вклад как римлян, так и викингов в население Британских островов был на удивление слабым. Гораздо большее влияние на происхождение современных британцев оказали более поздние миграции англосаксов.

8 мая, 17:12
СПбГУ

Нейробиологи СПбГУ продемонстрировали, что активация рецептора следовых аминов TAAR1 эффективно подавляет агрессивное поведение, вызванное полным отсутствием серотонина в мозге. В дальнейшем этот результат поможет в разработке лекарственных препаратов, направленных на коррекцию патологических форм агрессии, возникающих при посттравматическом стрессовом расстройстве (ПТСР) и шизофрении.

11 мая, 06:54
Лена

Крупные травоядные утконосые майазавры известны своим развитым социальным поведением. Они жили семьями и строили гнезда для своих детенышей. Даже название вида переводится с греческого языка как «ящер — хорошая мать». Исследование окаменелых зубов майазавров показало, что они выращивали детенышей совсем не так, как это считалось типичным для животных глубокой древности.

9 мая, 12:15
Любовь С.

Астрономы впервые использовали гравитационные волны, чтобы косвенно оценить параметры одного из ключевых процессов термоядерного горения в массивных светилах. Именно от него зависит, какие звезды взрываются, какие превращаются в черные дыры и как во Вселенной появляются углерод и кислород — элементы, без которых не было бы ни планет, ни жизни.

23 апреля, 18:34
Александр Березин

В последнее время пуски с российских северных космодромов осуществляют без предварительного уведомления, чего не было в прошлом. Вероятно, дело в недавно упомянутых главой «Роскосмоса» атаках на Плесецк во время пуска. Сегодняшний запуск обеспечил вывод на орбиту космических аппаратов военного назначения.

21 апреля, 20:03
Evgenia Vavilova

Химические связи в материале, из которого сделана электроника, разрываются не из-за накопительного износа от протекания тока через них, а из-за электронов с конкретной энергией.

20 апреля, 13:29
Илья Гриднев

Термоядерные электростанции не смогут конкурировать по цене с возобновляемыми источниками энергии из-за медленного удешевления технологии. По расчетам, расходы на каждую новую установку падали максимум на 8% — много раз ниже ранних ожиданий венчурных инвесторов. Это перечеркивает экономический смысл финансовых вливаний, и мир может никогда не увидеть дешевой термоядерной энергии.

[miniorange_social_login]

Комментарии

8 Комментариев
Ванечка
02.06.2019
-
0
+
Наибольшую угрозу представляет не ИИ и не правительства. Опаснее всего люди которые постят в коментах портянки на 3 экрана. Но ничего я верю что ИИ цензор справится и здесь :)
Edil Edil
02.06.2019
-
0
+
неужели AI-цензор здесь? или люди не спят в 4-00 в воскресенье?
Edil Edil
02.06.2019
-
1
+
facebook /pg/Выживание-415144336000566/posts/
Edil Edil
02.06.2019
-
1
+
Наибольшую угрозу представляет не правительство США, а именно Кремлевская группировка. Демократия – это не "понт", а работающие социальные механизмы ограничивающие произвол правителей. В Европе и США они не совершенны, но почти достаточны для прохождения "Великого фильтра". Российская же модель "Управляемой демократии" представляет собой угрозу большую, чем угроза от потепления, вулканов и всех естественных угроз вместе взятых. И, если угроза ядерной войны ≈20-25%, то угроза "Политической сингулярности" >50%, - Это использование Искусственного интеллекта для манипуляции сознанием "Вань". Да, "Политическая сингулярность" совсем не так страшна, как ядерная война, но только – первые 200 лет, пока правители будут зависимы от проблемного населения. Поэтому правильнее говорить не - Мы - Хозяин и я, и Они - европейцы, а - Мы - простые люди, и Они - правители. Допустим, Ване уже безразлична мучительная смерть его правнуков, тогда пусть он просто сравнит жизнь свою и германца, которого он хочет "повторить". И еще: Ракеты средней дальности опасны именно малым временем исправления ошибок автоматики. И нарушил этот Договор именно Кремль. И именно он выступает в роли шантажиста-террориста, взявшего в заложники 7 млрд. - И именно в РФ более вероятен сбой вооружения. Война нужна не-людям, - не само-определяющим свою жизнь (а это и есть "демократия"). То есть "демократия" – это не просто "ценности", а метод: a. Предотвращения войны, b. Предотвращения злоупотребления властью, которое погубит человечество. Про нарушение РСМД: "Минобороны России само предоставило в руки США доказательства нарушения РФ договора ДРСМД" https://rusmonitor.com/minoborony-rossii-samo-predostavilo-v-ruki-ssha-dokazatelstva-narusheniya-rf-dogovora-drsmd.html "Посол США в России передали координаты и даты испытаний ракеты 9М729" www.gazeta.ru/army/news/2019/02/04/12600553.shtml "Кремль не ожидал, что Трамп решится". Обвинения Кремлем США – вздор. "Нет другой возможности заставить Путина" www.svoboda.org/a/usa-today-inf-treaty/29566762.html Дело не в личности правителей, а в условиях, в которые они поставлены. - Институты демократии вынуждают чистоту помыслов западных правителей. - на Западе институты плохо ли, но как-то работают, а в РФ – вместо открытости, подконтрольности и т.д. работают другие механизмы - пропаганды. Дело не в конкретном правителе. Он, кстати, после следующих выборов, вероятно, останется на другом - усиленном посту, в "президенты" не вернется. Да, одной демократии и сменяемости власти недостаточно. Вы правы насчет Гитлера. Людьми можно манипулировать, настраивать их себе во вред, создавать лояльное большинство. Поэтому и продвигаю "Триаду спасения": 1. "Совещательная структура" – для профессионального потребления политики, противодействия, в частности, "промыванию мозгов" (продвигаю с 1990-го). 2. Онлайн-"игра" "Народовластие", с помощью спутникового Интернета, 3. Содружество микро-"государств" "Свободная (Южная) Россия" – для увеличения политической конкуренции. Экономика без демократии? Деньги дают власть, Правители проходят естественный отбор на алчность, цинизм и лицемерие. 1. Неконтролируемый коррупционер поднимает свою цену с помощью искусственных сложностей, и, этим тормозит экономику. Дешевая нефть как причина – это обман. 2. Если при разделе "пирога" нет механизма проведения интересов людей, то они проигрывают. Сравните неравенство доходов в Финляндии, Скандинавии и в РФ. Есть глубокие исследования о связи демократии и уровня жизни. На 1-го фанатика Ли Куан Ю, который сажал в тюрьму друзей приходится сотня "нормальных". Конечно, спорный вопрос - где счастливее люди – в КНР либо на Тайване. - Здесь речь не о воспитании общества "волков", а о выживании. "Выживальщикам" бы лучше подумать не об эффективности убийства голодных детей, а о недопущении таковых. Про сингулярность: https://habr.com/ru/post/293156/ Я тоже считаю, что на Западе многие сильно ошибаются насчет ИИ, Бостром, например, ИИ антропоморфизирует. Угрозу, связанную с ИИ, на Западе в определенном смысле - недооценивают. Угроза эта будет исходить не от самого ИИ, а от использования его владельцами, и, прежде всего – правителями – не находящимися под демократическим контролем.
Edil Edil
02.06.2019
-
1
+
Про сингулярность: https://habr.com/ru/post/293156/ Я тоже считаю, что на Западе многие сильно ошибаются насчет ИИ, Бостром, например, ИИ антропоморфизирует. Угрозу, связанную с ИИ, на Западе в определенном смысле - недооценивают. Угроза эта будет исходить не от самого ИИ, а от использования его владельцами, и, прежде всего – правителями – не находящимися под демократическим контролем. Наибольшую угрозу представляет не правительство США, а именно Кремлевская группировка. Демократия – это не "понт", а работающие социальные механизмы ограничивающие произвол правителей. В Европе и США они не совершенны, но почти достаточны для прохождения "Великого фильтра". Российская же модель "Управляемой демократии" представляет собой угрозу большую, чем угроза от потепления, вулканов и всех естественных угроз вместе взятых. И, если угроза ядерной войны ≈20-25%, то угроза "Политической сингулярности" >50%, - Это использование Искусственного интеллекта для манипуляции сознанием "Вань". Да, "Политическая сингулярность" совсем не так страшна, как ядерная война, но только – первые 200 лет, пока правители будут зависимы от проблемного населения. Поэтому правильнее говорить не - Мы - Хозяин и я, и Они - европейцы, а - Мы - простые люди, и Они - правители. Допустим, Ване уже безразлична мучительная смерть его правнуков, тогда пусть он просто сравнит жизнь свою и германца, которого он хочет "повторить". И еще: Ракеты средней дальности опасны именно малым временем исправления ошибок автоматики. И нарушил этот Договор именно Кремль. И именно он выступает в роли шантажиста-террориста, взявшего в заложники 7 млрд. - И именно в РФ более вероятен сбой вооружения. Война нужна не-людям, - не само-определяющим свою жизнь (а это и есть "демократия"). То есть "демократия" – это не просто "ценности", а метод: a. Предотвращения войны, b. Предотвращения злоупотребления властью, которое погубит человечество. Дело не в личности правителей, а в условиях, в которые они поставлены. - Институты демократии вынуждают чистоту помыслов западных правителей. - на Западе институты плохо ли, но как-то работают, а в РФ – вместо открытости, подконтрольности и т.д. работают другие механизмы - пропаганды. Дело не в конкретном правителе. Он, кстати, после следующих выборов, вероятно, останется на другом - усиленном посту, в "президенты" не вернется. Да, одной демократии и сменяемости власти недостаточно. Вы правы насчет Гитлера. Людьми можно манипулировать, настраивать их себе во вред, создавать лояльное большинство. Поэтому и продвигаю "Триаду спасения": 1. "Совещательная структура" – для профессионального потребления политики, противодействия, в частности, "промыванию мозгов" (продвигаю с 1990-го). 2. Онлайн-"игра" "Народовластие", с помощью спутникового Интернета, 3. Содружество микро-"государств" "Свободная (Южная) Россия" – для увеличения политической конкуренции. Экономика без демократии? Деньги дают власть, Правители проходят естественный отбор на алчность, цинизм и лицемерие. 1. Неконтролируемый коррупционер поднимает свою цену с помощью искусственных сложностей, и, этим тормозит экономику. Дешевая нефть как причина – это обман. 2. Если при разделе "пирога" нет механизма проведения интересов людей, то они проигрывают. Сравните неравенство доходов в Финляндии, Скандинавии и в РФ. Есть глубокие исследования о связи демократии и уровня жизни. На 1-го фанатика Ли Куан Ю, который сажал в тюрьму друзей приходится сотня "нормальных". Конечно, спорный вопрос - где счастливее люди – в КНР либо на Тайване. - Здесь речь не о воспитании общества "волков", а о выживании. "Выживальщикам" бы лучше подумать не об эффективности убийства голодных детей, а о недопущении таковых. Про нарушение РСМД: "Минобороны России само предоставило в руки США доказательства нарушения РФ договора ДРСМД" https://rusmonitor.com/minoborony-rossii-samo-predostavilo-v-ruki-ssha-dokazatelstva-narusheniya-rf-dogovora-drsmd.html "Посол США в России передали координаты и даты испытаний ракеты 9М729" www.gazeta.ru/army/news/2019/02/04/12600553.shtml "Кремль не ожидал, что Трамп решится". Обвинения Кремлем США – вздор. "Нет другой возможности заставить Путина" www.svoboda.org/a/usa-today-inf-treaty/29566762.html
-
0
+
Не вериться, но что бы накачаться и похудеть не нужно ходить в качалку или жрать химию. Опробовал лично и результат удивил: за две недели убрал пузо и скинул пару кило, а жена накачала попу и убрала в талии пару сантиметров и это все без спорта, диет и химии!Реально крутая штука, а вычитал о ней здесь ---- http://most.tk/nnblog
Дота - последняя надежда человечества.
Подтвердить?
Подтвердить?
Причина отклонения
Подтвердить?
Не получилось опубликовать!

Вы попытались написать запрещенную фразу или вас забанили за частые нарушения.

Понятно
Комментарий на проверке

Что-то в вашем комментарии показалось подозрительным, поэтому перед публикацией он пройдет модерацию.

Понятно
Жалоба отправлена

Мы обязательно проверим комментарий и
при необходимости примем меры.

Спасибо
Аккаунт заблокирован!

Из-за нарушений правил сайта на ваш аккаунт были наложены ограничения. Если это ошибка, напишите нам.

Понятно
Что-то пошло не так!

Наши фильтры обнаружили в ваших действиях признаки накрутки. Отдохните немного и вернитесь к нам позже.

Понятно
Лучшие материалы
Закрыть
Войти
Авторизуясь, вы даете согласие на обработку персональных данных и подтверждаете ознакомление с Политикой.
Ваша заявка получена

Мы скоро изучим заявку и свяжемся с Вами по указанной почте в случае положительного исхода. Спасибо за интерес к проекту.

Понятно