31.05.2019, 10:33

alex007

16,6 тыс

Искусственный интеллект DeepMind победил людей в кооперативной игре Quake III Arena

Агенты нейросети тренировались на тысячах игр одновременно, проведя около 450 тысяч матчей.

Технологии

# DeepMind

# искусственный интеллект

# машинное обучение

# обучение с подкреплением

©Wikipedia / Автор: Sycophanta Duccius

Сотрудники британской компании DeepMind, которая с 2014 года принадлежит Google, опубликовали статью в журнале Science, посвященную успехам их искусственного интеллекта. На этот раз они смогли натренировать алгоритм на командную игру в режиме «Захват флага» мультиплеерного шутера Quake III Arena. Команда из агентов ИИ в подавляющем количестве игр победила команду людей.

Для тренировки агентов специалисты использовали обучение с подкреплением — метод машинного обучения, при котором система учится, взаимодействуя со средой. Авторы статьи пишут, что этот метод успешно зарекомендовал себя в обучении одного агента, но они хотели узнать, насколько он успешен при командной работе.

В качестве платформы они выбрали мультиплеерный шутер от первого лица Quake III Arena, но задали свои условия игры. Во-первых, карты каждый раз генерируются случайно. Во-вторых, в матче принимают участие только четыре игрока: по два с каждой стороны. Соревнование проходит только в одном режиме — «Захват флага»: каждая из команд должна одновременно защитить свой флаг, захватить флаг оппонентов и принести на свою базу. Реакцию системы снизили до средних показателей человека.

Авторы тренировали 30 агентов. Тренировка происходила благодаря многотысячным параллельным партиям, которые отыгрывали агенты. При этом каждый агент представлял собой индивидуальную единицу, которая действует самостоятельно, исходя из обучения с подкреплением. Специалисты также демонстрируют филогенетическое дерево, которое строится в ходе этого обучения.

Процесс обучения / ©Science

После тренировок алгоритмы сыграли несколько партий с командой людей. Обе команды играли на неизвестных для них картах. Пара агентов за игру в среднем захватывала на 16 флагов больше, чем пара людей. Только когда человек играл в партнерстве с искусственным интеллектом, ему удавалось выиграть у объединения алгоритмов (5% вероятности победы).

Профессор Технологического колледжа Джорджии Марк Ридл (Mark Riedl) раскритиковал такой подход британской фирмы, сказав, что агенты не обмениваются сообщениями, а лишь реагируют на те события, которые происходят в игре. Однако представитель DeepMind Макс Джадерберг (Max Jaderberg) возразил:

«[В нашей симуляции] один из агентов сидит в лагере противника, ожидая, когда вновь появится флаг, это возможно только потому, что он полагается на своего партнера по команде».

Джадерберг говорит об одной из тактик искусственного интеллекта, выработанной тем в ходе обучения, которая предполагает ожидание появления нового флага в лагере оппонента. Ее часто используют и люди.

В январе DeepMind сообщила, что ее искусственный интеллект AlphaStar одолел двух профессиональных игроков в стратегию StarCraft II, проходящую в реальном времени.

Нашли опечатку? Выделите фрагмент и нажмите Ctrl + Enter.

Технологии

# DeepMind

# искусственный интеллект

# машинное обучение

# обучение с подкреплением

Подписывайтесь на нас в Telegram, Яндекс.Новостях и VK

Дзен

Предстоящие мероприятия

ВДНХ

Москва

Лекция

20 Май

Бесплатно

Горная порода: структура или хаос

СПбГУ

Санкт-Петербург

Лекция

20 Май

600 ₽

Необычная криптография: Конфиденциальные вычисления

Центр «Архэ»

Онлайн

Лекция

20 Май

Бесплатно

Человек как система: инженерный подход к живому

Москва

Быстрые радиовсплески и долгопериодические радиотранзиенты

Центр «Архэ»

Москва

Лекция

21 Май

Бесплатно

Активные ядра галактик и джеты: космические двигатели Вселенной

ФизТех

Москва

Лекция

21 Май

Бесплатно

Полярная авиация от аэростата до экраноплана

Русское географическое общество

Москва

Лекция

21 Май

Бесплатно

От большого к малому — как создание цифровых двойников позволяет учитывать микронные особенности структуры при описании километровых объектов

Москва

Как изотопы могут раскрыть секреты метаболизма?

Курилка Гутенберга

Москва

Популярное

За сутки

За неделю

За месяц

18 мая, 11:29

РНФ

Ученые раскрыли «темную сторону» светящегося зеленого белка

Ученые впервые охарактеризовали «темное» электронное состояние в светочувствительном фрагменте зеленого флуоресцентного белка. Химически изменив этот фрагмент, авторы целенаправленно «выключили» его свечение: в возникшем темном состоянии молекула не излучает свет, а накапливает энергию ультрафиолета, чтобы затем безопасно от нее избавиться. Защитный механизм запускается за рекордно короткое время — благодаря сверхбыстрой перестройке электронов и ядер молекула избегает разрушения под внешним излучением. Открытие будет полезно для разработки нового поколения солнцезащитных материалов и покрытий с программируемой фотостабильностью.

РНФ

# белки

# молекула

# флуорисценция

# химия

17 мая, 16:20

Николай Цыгикало

Невидимая география космоса: как устроены высокие орбиты для спутников

Высота космической орбиты — это не просто удаление от поверхности Земли. Она позволяет выполнять полетные задания, недоступные для других орбит. Какими бывают высокие околоземные орбиты, что они дают спутникам и как обеспечивают им необычные условия для работы, рассказываем в нашем новом материале.

Космонавтика

# «Глонасс-К»

# ESA

# NASA

# космос

# околоземная орбита

# орбита

# Роскосмос

# спутник

# технологии

Выбор редакции

17 мая, 10:35

Игорь Байдов

В Гималаях людям и другим животным начал угрожать новый хищник

В высокогорных районах Гималаев появился новый хищник. Он не боится людей, возглавляет стаи собак и все чаще заходит в деревни. Местные жители называют его «кхипшанг». Речь идет о гибриде гималайского волка и бродячей собаки. Ученые опасаются, что этот зверь изменит хрупкий баланс местной дикой природы и в скором времени станет весьма опасным для человека.

Биология

# бездомные животные

# волк

# волки

# Гималаи

# животные

# Индия

# собаки

17 мая, 10:35

Игорь Байдов

В Гималаях людям и другим животным начал угрожать новый хищник

Биология

# бездомные животные

# волк

# волки

# Гималаи

# животные

# Индия

# собаки

17 мая, 10:00

Evgenia Vavilova

Физики разобрались, что нужно, чтобы человек видел в инфракрасном спектре

При совпадении нескольких условий наши глаза способны улавливать излучение в ближнем инфракрасном спектре. Тогда сетчатка начинает работать как нелинейный фотодетектор.

Физика

# ближний инфракрасный диапазон

# зрение

# лазер

# сетчатка глаза

# фотоны

18 мая, 09:10

Лена

Ученые выяснили, почему большинство людей правши

Во всем мире во всех человеческих культурах около 90% людей пользуются преимущественно правой рукой. Такое поразительное единство практически всего человечества не имеет аналогов среди приматов и до сих пор остается эволюционной загадкой. Ученые проанализировали данные о более чем двух тысячах человекообразных обезьянах и выяснили, когда и почему праворукость стала популяционной тенденцией.

Биология

# генетика

# популяция

# праворукость

# эволюция

23 апреля, 18:34

Александр Березин

С Плесецка без предупреждения запустили легкую ракету «Ангара»

В последнее время пуски с российских северных космодромов осуществляют без предварительного уведомления, чего не было в прошлом. Вероятно, дело в недавно упомянутых главой «Роскосмоса» атаках на Плесецк во время пуска. Сегодняшний запуск обеспечил вывод на орбиту космических аппаратов военного назначения.

Космонавтика

# космонавтика

# космос

# Россия

17 мая, 10:35

Игорь Байдов

В Гималаях людям и другим животным начал угрожать новый хищник

Биология

# бездомные животные

# волк

# волки

# Гималаи

# животные

# Индия

# собаки

21 апреля, 20:03

Evgenia Vavilova

Физики выяснили, что электроника деградирует не по накопительному, а по квантовому механизму

Химические связи в материале, из которого сделана электроника, разрываются не из-за накопительного износа от протекания тока через них, а из-за электронов с конкретной энергией.

Физика

# водород

# горячие электроны

# деградация

# полупроводники

# электроника

[miniorange_social_login]

Наибольшую угрозу представляет не ИИ и не правительства. Опаснее всего люди которые постят в коментах портянки на 3 экрана. Но ничего я верю что ИИ цензор справится и здесь :)

Ответить

Edil Edil

02.06.2019

неужели AI-цензор здесь? или люди не спят в 4-00 в воскресенье?

Ответить

Edil Edil

02.06.2019

facebook /pg/Выживание-415144336000566/posts/

Ответить

Edil Edil

02.06.2019

Наибольшую угрозу представляет не правительство США, а именно Кремлевская группировка. Демократия – это не "понт", а работающие социальные механизмы ограничивающие произвол правителей. В Европе и США они не совершенны, но почти достаточны для прохождения "Великого фильтра". Российская же модель "Управляемой демократии" представляет собой угрозу большую, чем угроза от потепления, вулканов и всех естественных угроз вместе взятых. И, если угроза ядерной войны ≈20-25%, то угроза "Политической сингулярности" >50%, - Это использование Искусственного интеллекта для манипуляции сознанием "Вань". Да, "Политическая сингулярность" совсем не так страшна, как ядерная война, но только – первые 200 лет, пока правители будут зависимы от проблемного населения. Поэтому правильнее говорить не - Мы - Хозяин и я, и Они - европейцы, а - Мы - простые люди, и Они - правители. Допустим, Ване уже безразлична мучительная смерть его правнуков, тогда пусть он просто сравнит жизнь свою и германца, которого он хочет "повторить". И еще: Ракеты средней дальности опасны именно малым временем исправления ошибок автоматики. И нарушил этот Договор именно Кремль. И именно он выступает в роли шантажиста-террориста, взявшего в заложники 7 млрд. - И именно в РФ более вероятен сбой вооружения. Война нужна не-людям, - не само-определяющим свою жизнь (а это и есть "демократия"). То есть "демократия" – это не просто "ценности", а метод: a. Предотвращения войны, b. Предотвращения злоупотребления властью, которое погубит человечество. Про нарушение РСМД: "Минобороны России само предоставило в руки США доказательства нарушения РФ договора ДРСМД" https://rusmonitor.com/minoborony-rossii-samo-predostavilo-v-ruki-ssha-dokazatelstva-narusheniya-rf-dogovora-drsmd.html "Посол США в России передали координаты и даты испытаний ракеты 9М729" www.gazeta.ru/army/news/2019/02/04/12600553.shtml "Кремль не ожидал, что Трамп решится". Обвинения Кремлем США – вздор. "Нет другой возможности заставить Путина" www.svoboda.org/a/usa-today-inf-treaty/29566762.html Дело не в личности правителей, а в условиях, в которые они поставлены. - Институты демократии вынуждают чистоту помыслов западных правителей. - на Западе институты плохо ли, но как-то работают, а в РФ – вместо открытости, подконтрольности и т.д. работают другие механизмы - пропаганды. Дело не в конкретном правителе. Он, кстати, после следующих выборов, вероятно, останется на другом - усиленном посту, в "президенты" не вернется. Да, одной демократии и сменяемости власти недостаточно. Вы правы насчет Гитлера. Людьми можно манипулировать, настраивать их себе во вред, создавать лояльное большинство. Поэтому и продвигаю "Триаду спасения": 1. "Совещательная структура" – для профессионального потребления политики, противодействия, в частности, "промыванию мозгов" (продвигаю с 1990-го). 2. Онлайн-"игра" "Народовластие", с помощью спутникового Интернета, 3. Содружество микро-"государств" "Свободная (Южная) Россия" – для увеличения политической конкуренции. Экономика без демократии? Деньги дают власть, Правители проходят естественный отбор на алчность, цинизм и лицемерие. 1. Неконтролируемый коррупционер поднимает свою цену с помощью искусственных сложностей, и, этим тормозит экономику. Дешевая нефть как причина – это обман. 2. Если при разделе "пирога" нет механизма проведения интересов людей, то они проигрывают. Сравните неравенство доходов в Финляндии, Скандинавии и в РФ. Есть глубокие исследования о связи демократии и уровня жизни. На 1-го фанатика Ли Куан Ю, который сажал в тюрьму друзей приходится сотня "нормальных". Конечно, спорный вопрос - где счастливее люди – в КНР либо на Тайване. - Здесь речь не о воспитании общества "волков", а о выживании. "Выживальщикам" бы лучше подумать не об эффективности убийства голодных детей, а о недопущении таковых. Про сингулярность: https://habr.com/ru/post/293156/ Я тоже считаю, что на Западе многие сильно ошибаются насчет ИИ, Бостром, например, ИИ антропоморфизирует. Угрозу, связанную с ИИ, на Западе в определенном смысле - недооценивают. Угроза эта будет исходить не от самого ИИ, а от использования его владельцами, и, прежде всего – правителями – не находящимися под демократическим контролем.

Ответить

Edil Edil

02.06.2019

Про сингулярность: https://habr.com/ru/post/293156/ Я тоже считаю, что на Западе многие сильно ошибаются насчет ИИ, Бостром, например, ИИ антропоморфизирует. Угрозу, связанную с ИИ, на Западе в определенном смысле - недооценивают. Угроза эта будет исходить не от самого ИИ, а от использования его владельцами, и, прежде всего – правителями – не находящимися под демократическим контролем. Наибольшую угрозу представляет не правительство США, а именно Кремлевская группировка. Демократия – это не "понт", а работающие социальные механизмы ограничивающие произвол правителей. В Европе и США они не совершенны, но почти достаточны для прохождения "Великого фильтра". Российская же модель "Управляемой демократии" представляет собой угрозу большую, чем угроза от потепления, вулканов и всех естественных угроз вместе взятых. И, если угроза ядерной войны ≈20-25%, то угроза "Политической сингулярности" >50%, - Это использование Искусственного интеллекта для манипуляции сознанием "Вань". Да, "Политическая сингулярность" совсем не так страшна, как ядерная война, но только – первые 200 лет, пока правители будут зависимы от проблемного населения. Поэтому правильнее говорить не - Мы - Хозяин и я, и Они - европейцы, а - Мы - простые люди, и Они - правители. Допустим, Ване уже безразлична мучительная смерть его правнуков, тогда пусть он просто сравнит жизнь свою и германца, которого он хочет "повторить". И еще: Ракеты средней дальности опасны именно малым временем исправления ошибок автоматики. И нарушил этот Договор именно Кремль. И именно он выступает в роли шантажиста-террориста, взявшего в заложники 7 млрд. - И именно в РФ более вероятен сбой вооружения. Война нужна не-людям, - не само-определяющим свою жизнь (а это и есть "демократия"). То есть "демократия" – это не просто "ценности", а метод: a. Предотвращения войны, b. Предотвращения злоупотребления властью, которое погубит человечество. Дело не в личности правителей, а в условиях, в которые они поставлены. - Институты демократии вынуждают чистоту помыслов западных правителей. - на Западе институты плохо ли, но как-то работают, а в РФ – вместо открытости, подконтрольности и т.д. работают другие механизмы - пропаганды. Дело не в конкретном правителе. Он, кстати, после следующих выборов, вероятно, останется на другом - усиленном посту, в "президенты" не вернется. Да, одной демократии и сменяемости власти недостаточно. Вы правы насчет Гитлера. Людьми можно манипулировать, настраивать их себе во вред, создавать лояльное большинство. Поэтому и продвигаю "Триаду спасения": 1. "Совещательная структура" – для профессионального потребления политики, противодействия, в частности, "промыванию мозгов" (продвигаю с 1990-го). 2. Онлайн-"игра" "Народовластие", с помощью спутникового Интернета, 3. Содружество микро-"государств" "Свободная (Южная) Россия" – для увеличения политической конкуренции. Экономика без демократии? Деньги дают власть, Правители проходят естественный отбор на алчность, цинизм и лицемерие. 1. Неконтролируемый коррупционер поднимает свою цену с помощью искусственных сложностей, и, этим тормозит экономику. Дешевая нефть как причина – это обман. 2. Если при разделе "пирога" нет механизма проведения интересов людей, то они проигрывают. Сравните неравенство доходов в Финляндии, Скандинавии и в РФ. Есть глубокие исследования о связи демократии и уровня жизни. На 1-го фанатика Ли Куан Ю, который сажал в тюрьму друзей приходится сотня "нормальных". Конечно, спорный вопрос - где счастливее люди – в КНР либо на Тайване. - Здесь речь не о воспитании общества "волков", а о выживании. "Выживальщикам" бы лучше подумать не об эффективности убийства голодных детей, а о недопущении таковых. Про нарушение РСМД: "Минобороны России само предоставило в руки США доказательства нарушения РФ договора ДРСМД" https://rusmonitor.com/minoborony-rossii-samo-predostavilo-v-ruki-ssha-dokazatelstva-narusheniya-rf-dogovora-drsmd.html "Посол США в России передали координаты и даты испытаний ракеты 9М729" www.gazeta.ru/army/news/2019/02/04/12600553.shtml "Кремль не ожидал, что Трамп решится". Обвинения Кремлем США – вздор. "Нет другой возможности заставить Путина" www.svoboda.org/a/usa-today-inf-treaty/29566762.html

Ответить

Миша Маслов

01.06.2019

Не вериться, но что бы накачаться и похудеть не нужно ходить в качалку или жрать химию. Опробовал лично и результат удивил: за две недели убрал пузо и скинул пару кило, а жена накачала попу и убрала в талии пару сантиметров и это все без спорта, диет и химии!Реально крутая штука, а вычитал о ней здесь ---- http://most.tk/nnblog

Ответить

ulogin_facebook_1675895662457286

31.05.2019

Дота - последняя надежда человечества.

Ответить

—

Edil Edil

02.06.2019

неужели AI-цензор здесь? или люди не спят в 4-00 в воскресенье?

Ответить

Edil Edil

02.06.2019

Ответить

Edil Edil

02.06.2019

Ответить

Edil Edil

02.06.2019

facebook /pg/Выживание-415144336000566/posts/

Ответить

ulogin_facebook_1675895662457286

31.05.2019

Дота - последняя надежда человечества.

Ответить

—

Edil Edil

02.06.2019

неужели AI-цензор здесь? или люди не спят в 4-00 в воскресенье?

Ответить

Миша Маслов

01.06.2019

Ответить

Edil Edil

02.06.2019

неужели AI-цензор здесь? или люди не спят в 4-00 в воскресенье?

Ответить

Ванечка

02.06.2019

Ответить

Искусственный интеллект DeepMind победил людей в кооперативной игре Quake III Arena

По теме

Гипертонию «вычислили» по голосу пациента

Знаете ли вы…

Искусственный интеллект позволит диагностировать болезни растений по фотографиям

Популярное

Комментарии

Последние новости:

Гравитационные волны резко ограничили число первичных черных дыр

Математики предложили новую меру близости в сетях в присутствии коллективных связей

Даже одна доза псилоцибина быстро избавила от депрессии

Страх перед трещоткой гремучей змеи оказался врожденным у американских животных

Невидимая география космоса: как устроены высокие орбиты для спутников

Как США и Китай превратили телескопы в новое поле геополитической битвы

Как Гитлер уничтожил Францию за шесть недель — и почему СССР едва не повторил ее судьбу

Почему американцы возвращаются на Луну через полвека перерыва: видеоподкаст Naked Science

Последние комментарии

Самые обсуждаемые

Ученые выяснили, почему большинство людей правши

Исследователи объяснили, почему прогулки на природе делают людей счастливыми

Континенты Земли образовались в результате «подныривания» тектонических плит

У пассажиров поездов обнаружили «эффект следования за незнакомцем»