Алгоритм машинного обучения дает советы по управлению ядерным синтезом
Коллаборация Швейцарского плазменного центра и компании DeepMind разработала новый метод магнитного управления плазмой в токамаке. Алгоритм глубокого обучения с подкреплением, разработанный DeepMind, позволяет значительно ускорить подбор настройки токамака для создания наперед заданных конфигураций плазмы с высокой точностью.
Токамак, или тороидальная камера с магнитными катушками, представляет собой установку тороидальной формы (бублика или пончика), в котором создаются условия для протекания управляемого термоядерного синтеза — тех же реакций, что проходят в недрах звезд. С этой целью в токамаках генерируются мощные магнитные поля и создается вакуум для удержания высокотемпературной плазмы и защиты стенок установки от расплавления. Теоретически высвобождаемую в этом процессе энергию можно использовать для производства электроэнергии.
Швейцарский плазменный центр (SPC) Федеральной политехнической школы Лозанны (EPFL) обладает многолетним опытом в области физики плазмы и методов управления ею. Мало того что SPC — один из немногих исследовательских центров в мире, обладающих действующим токамаком, так еще установка у них весьма непростая. Их токамак допускает различные конфигурации плазмы, задаваемых положением магнитных катушек, поэтому и называется токамаком переменной конфигурации (TCV).
Конфигурация плазмы связана с ее формой и положением в токамаке, а от этого зависит устойчивость плазмы и производительность реактора, то есть количество генерируемой энергии. Перед проведением экспериментов на своей установке исследователи из SPC сначала проверяют конфигурации систем управления на симуляторе.

«Наш симулятор основан более чем на 20-летних исследованиях и постоянно обновляется, — поясняет Федерико Феличи (Federico Felici), сотрудник SPC и соавтор исследования. — Но даже в этом случае для определения правильного значения каждой переменной в системе управления по-прежнему необходимы длительные расчеты. Вот тут-то и появляется наш совместный исследовательский проект с DeepMind».
DeepMind — британская компания, занимающаяся научными открытиями и вопросами ИИ, которую Google приобрела в 2014 году и которая стремится «решать проблемы искусственного интеллекта для развития науки и человечества». Эксперты DeepMind разработали алгоритм глубокого обучения с подкреплением (deep reinforcement learning, DRL), который может создавать и поддерживать определенные конфигурации плазмы, и обучили его на симуляторе SPC.
Вначале алгоритм тестировал множество различных стратегий управления плазмой в симуляции для накопления опыта. Причем обучение проходило в две стороны: сначала алгоритму давали ряд настроек для управления установкой, по которым на симуляторе генерировалась плазма, а алгоритм анализировал ее конфигурацию; затем по конфигурации плазмы алгоритмом определялись правильные настройки.

После обучения система на основе алгоритма DRL смогла создавать и поддерживать широкий спектр форм плазмы и расширенных конфигураций в симуляторе, в том числе такую, при которой в реакторе одновременно поддерживаются два отдельных фрагмента плазмы.
Наконец, исследовательская группа протестировала свою новую систему непосредственно на токамаке, чтобы увидеть, как она будет работать в реальных условиях. Как и предполагалось, все созданные алгоритмом DRL и предсказанные симулятором SPC конфигурации удалось получить на реальной установке. Таким образом, новый подход к управлению магнитными катушками токамака не только позволяет ускорить создание необходимых конфигураций плазмы, но и обеспечивает точное отслеживание местоположения, тока и формы для этих конфигураций.
Мартин Ридмиллер (Martin Riedmiller), руководитель группы управления в DeepMind и соавтор исследования, отметил: «Миссия нашей команды состоит в том, чтобы исследовать системы искусственного интеллекта нового поколения — контроллеры с обратной связью, — которые могут обучаться на сложных динамических средах с нуля. Управление термоядерной плазмой в реальных установках предлагает фантастические, хотя и чрезвычайно сложные возможности».
Статья с результатами исследования опубликована в журнале Nature.
Исследователи из США нашли в организме человека ранее неизвестный пептид BRP и проверили его работу на животных. В экспериментах он помог снизить аппетит и процент содержания жира без побочных эффектов. По механизму действия BRP напоминает препараты для снижения веса на основе ГПП-1, к которым относится семаглутид, но, предположительно, действует иначе: не через кишечник и поджелудочную железу, а преимущественно через центральные сигнальные пути в мозге, включая области гипоталамуса, участвующие в регуляции аппетита. Авторы новой научной работы рассматривают открытие как основу для принципиально нового класса лекарств от ожирения.
Формально почти вся программа тринадцатого полета самой большой ракеты в истории выполнена. Однако испытания показали неполную отлаженность ключевого элемента системы. SpaceX оказывается в ситуации действительно плотных сроков: до намеченного возвращения людей на Луну всего два года и два месяца.
Четыре точки Европы показали одну и ту же картину: как минимум несколько десятков тысяч лет регулярных сильных пожаров. До сих пор ученые не сталкивались с ископаемыми следами настолько длительных регулярных событий такого типа. Авторы новой работы предложили феномену объяснение, но оно имеет существенные недостатки.
Правильно подобранные звуковые последовательности способны не только стимулировать рост растений, но и влиять на их урожайность. К такому выводу пришли авторы нового исследования. Они разработали технологию, которая позволяет воздействовать на процессы развития растений через акустические сигналы без использования генной инженерии или химикатов. В экспериментах добились повышения урожайности мяты, сои, болгарского перца и конопли.
Формально почти вся программа тринадцатого полета самой большой ракеты в истории выполнена. Однако испытания показали неполную отлаженность ключевого элемента системы. SpaceX оказывается в ситуации действительно плотных сроков: до намеченного возвращения людей на Луну всего два года и два месяца.
Сегодня на земле существует примерно 7500 языков, однако ученые давно подозревали, что в прошлом их было значительно больше. Международная группа лингвистов реконструировала историю языкового разнообразия за последние 12 тысяч лет и пришла к выводу, что человечество уже пережило «золотой век» языков, после которого их число начало быстро сокращаться.
Видеосервисы стали неотъемлемой частью жизни россиян. В 2026 году охваты большинства платформ продолжают расти, в том числе YouTube.
Древнеримские инженеры проложили колоссальную сеть дорог через Европу, Северную Африку и Ближний Восток, многие участки которой до сих пор поражают безупречной прямолинейностью. Секрет строительства заключался в использовании трех особых геодезических инструментов, с помощью которых разбивали местность на ровные отрезки и размечали трассы.
Очереди на заправках стали привычным явлением в России, а на фоне информационного вакуума от властей о конкретных показателях производства бензина в июне население вынуждено ориентироваться на слухи. Все это выглядит довольно странно, но есть нюанс: скорее всего, кризис уже начинает выдыхаться. Как именно мы это выяснили?
Вы попытались написать запрещенную фразу или вас забанили за частые нарушения.
Понятно
Что-то в вашем комментарии показалось подозрительным, поэтому перед публикацией он пройдет модерацию.
Понятно
Из-за нарушений правил сайта на ваш аккаунт были наложены ограничения. Если это ошибка, напишите нам.
Понятно
Наши фильтры обнаружили в ваших действиях признаки накрутки. Отдохните немного и вернитесь к нам позже.
Понятно
Мы скоро изучим заявку и свяжемся с Вами по указанной почте в случае положительного исхода. Спасибо за интерес к проекту.
Понятно
Последние комментарии