1,4 тыс

Нейронная сеть научилась предсказывать структуру и функции любых белков

❋ 6.7

Специалисты из компании Google в сотрудничестве с Европейским институтом биоинформатики разработали нейронную сеть глубокого обучения, позволяющую предсказывать структуру, функции и свойства белков по их первичной структуре с высокой точностью. Новый инструмент позволит значительно облегчить и ускорить разработку новых лекарств и проектирование новых ферментов для промышленного производства продуктов питания, биотоплива и химикатов.

Офис Google в штате Массачусетс (США), где работает основная команда авторов исследования.
Офис Google в штате Массачусетс (США), где работает основная команда авторов исследования. / ©Kyle Paul

Понимание взаимосвязи между аминокислотной последовательностью (первичной структурой) и функцией белка, а значит, и механизмом его работы, — давняя проблема молекулярной биологии и настолько же давняя мечта специалистов самых разных областей промышленности, от фармацевтической до пищевой и химической.

Для производства различных химических веществ, будь то лекарство, пищевая добавка или химикат, естественно использовать лучшие из имеющихся катализаторов — ферменты, то есть белки. Причем для каждого приложения нужен свой белок с конкретной функцией (переноса электрона или отдельных химических групп, образования или разрыва химических связей и так далее). Человек еще не научился создавать такие ферменты с нуля, поэтому подсматривает возможные решения у природы и зачастую находит их в микроорганизмах.

Несмотря на шесть десятилетий прогресса, современные методы и алгоритмы не могут определить функции трети последовательностей уже известных микробных белков, что ограничивает возможности их применения в интересах человечества. В то же время каждый день в глобальные базы данных добавляют более ста тысяч новых белковых последовательностей.

Однако для практического применения от этих данных не много пользы, если они не сопровождаются функциональными аннотациями (то есть описанием функций белка и его биологической роли в клетке).

Увеличение размера базы данных Trembl (одной из баз данных белковых последовательностей) с течением времени и соответствующее снижение доли белков, функция которых точно определена (вручную)
Увеличение размера базы данных Trembl (одной из баз данных белковых последовательностей) с течением времени и соответствующее снижение доли белков, функция которых точно определена (вручную) / © Google Research/ProteInfer

Функцию белка можно выяснить экспериментально, используя ряд современных методов — анализ микрочипов, РНК-интерференцию, двугибридный анализ и другие. Но темпы экспериментального доказательства функций открытых белков сильно отстают от темпов открытия новых последовательностей, и навряд ли когда-либо их догонят.

Поэтому аннотирование новых белковых последовательностей будет проходить в основном путем предсказания на основе вычислительных методов, сравнивающих их с аминокислотными последовательностями белков с уже известными функциями, определенными экспериментально. При этом, когда возникнет необходимость в создании новой технологии производства (например того же лекарства), у ученых будут на руках предсказания нейросетей, по которым уже вручную надо будет определять наиболее подходящие белки-кандидаты и проверять их функции.

Новый вычислительный метод определения функций и свойств белков предлагает команда специалистов из Google Research (Кембридж, Массачусетс, США) и Европейской молекулярно-биологической лаборатории Европейского института биоинформатики (EMBL-EBI). Они разработали нейронную сеть глубокого обучения, предсказывающую не только функцию белка и его биологическую роль в клетке, но и его структуру, и функциональные эффекты мутаций (точечных изменений аминокислотной последовательности).

Производительность нейросети ProteInfer для прогнозов по всем 7 основным группам ферментов, представленная в виде кривых точности-отзыва, созданных путем изменения порога принятия решения, при котором делается прогноз.
Производительность нейросети ProteInfer для прогнозов по всем 7 основным группам ферментов, представленная в виде кривых точности-отзыва, созданных путем изменения порога принятия решения, при котором делается прогноз. / ©Google research/ProteInfer

Используя свой алгоритм, обученный на всемирной базе данных семейств аннотированных белковых доменов Pfam, исследователи дополнили ее новыми аннотациями с указанием функций белков с давно расшифрованной аминокислотной последовательностью. В итоге количество записей в базе данных выросло почти на 10%, включая 360 новых записей о функциях белков человека. По словам авторов, это самое большое обновление Pfam за последние 10 лет.

Разработка американских биоинформатиков призвана значительно упростить и ускорить так называемый драг-дизайн — направленную разработку новых лекарств с учетом строения и трехмерной структуры молекул-мишеней (зачастую именно белков), на которые это лекарство будет действовать. Кроме того, знание структуры белков и понимание механизмов их работы позволят облегчить разработку новых биотехнологических ферментов для пищевой, химической и энергетической промышленностей.

Статья с результатами исследования представлена в журнале Nature Biotechnology.

Помимо этого, авторы опубликовали интерактивную научную статью с подробным описанием работы их нейронной сети, оценками ее производительности и сравнением с аналогичными методами других проектов.

Нашли опечатку? Выделите фрагмент и нажмите Ctrl (Cmd) + Enter.
Подписывайтесь на нас в Telegram, Дзен и в последнюю очередь на VK
Предстоящие мероприятия
22 сентября, 12:52
Марк Чернов

Американские исследователи впервые смогли напрямую увидеть «квантовый скачок» звука — скачкообразный переход фонона, минимальной единицы звуковой энергии, между энергетическими уровнями в реальном времени. Это наблюдение завершило столетнюю историю поисков, начатую еще на заре квантовой физики, и открыло дорогу к созданию устойчивых квантовых компьютеров и сверхчувствительных датчиков.

22 сентября, 15:41
Татьяна Зайцева

Инфекции, которые могут передаваться от матери к плоду, связаны с повышенным риском развития аутизма и умственной отсталости у ребенка. Таковы результаты крупнейшего исследования в этой области, основанного на данных, охватывающих почти четыре миллиона человек.

22 сентября, 17:02
Марк Чернов

Ученые выяснили, что умеренные различия между элементами электросетей, экосистем и других сложных структур превращают их в гораздо более надежные системы. Математический расчет помог доказать: идеальная однородность делает энергосистемы, биоценозы и транспортные сети уязвимыми для сбоев, тогда как контролируемый «беспорядок» повышает их устойчивость к внешним нагрузкам.

21 сентября, 09:24
Елизавета З.

Европейское космическое агентство опубликовало снимок галактики NGC 4698, расположенной в созвездии Дева. Хотя на фотографии, сделанной телескопом «Хаббл», галактика кажется безмятежной, она хранит удивительную тайну: находящиеся в центре звезды и газ вращаются под прямым углом по отношению к остальной части диска.

21 сентября, 16:52
Редакция Naked Science

Всего 20-30 лет назад большинство женщин ходили на каблуках, а большинство мужчин — в обуви, подошва которой серьезно нагружала позвоночник и мышцы спины. Если задуматься, факт поразительный: 20 тысяч лет назад, в палеолите, таких проблем человечество вообще не испытывало. Как так получилось и что новые материалы делают, чтобы все эти сложности стали прошлым?

21 сентября, 16:53
Елизавета З.

«Яндекс» опубликовал в открытом доступе Alice AI Foundation LLM — претрейн-версию новой большой языковой модели, которую разработчики обучили полностью с нуля. Она хорошо справляется с рассуждениями и задачами по программированию, а качество ответов на русском языке опережает многие зарубежные аналоги. В первую очередь это касается задач на знание фактов, интересных русскоязычной аудитории. Модель обошла даже более крупные опенсорс-модели, при этом для ее интерфейса не нужны большие вычислительные мощности. Свободная лицензия Apache 2.0. позволяет задействовать ее как в исследовательских, так и в коммерческих проектах.

9 сентября, 22:44
Александр Березин

Нейросеть OpenAI добилась серьезного прорыва в математике, решив одну из семи «задач тысячелетия». Получат ли США, чьи нейросети опираются на гораздо более мощное «железо», чем у Китая, монополию на конвейер научных открытий? Даст ли это возможности сравнимые с их атомной монополией 80 лет назад?

28 августа, 15:43
Татьяна Зайцева

Сопротивление жителей Европы самой идее употребления насекомых в пищу может иметь эволюционные корни, уходящие вглубь тысячелетий, пришли к выводу авторы нового исследования. Оказалось, предки современных европейцев ели насекомых лишь эпизодически. Кроме того, из-за генетических мутаций они плохо переваривали их экзоскелеты.

29 августа, 16:51
Александр Березин

Госдолг США достиг 40 триллионов долларов и растет все быстрее и быстрее. На Западе переполох: при таких размерах его не выплатить. Следовательно, полагают многие, надо решить проблему как древние шумеры — долг обнулить и начать занимать заново. Рецепт кажется здравым, но есть нюансы. Причем поучительнее всего они даже не для Штатов, а, как ни странно, именно для России.

[miniorange_social_login]

Комментарии

Написать комментарий