• Добавить в закладки
  • Facebook
  • Twitter
  • Telegram
  • VK
  • Печать
  • Email
  • Скопировать ссылку
06.10.2022, 11:00
НИУ ВШЭ
29
3,0 тыс

В НИУ ВШЭ построили рейтинг тем, вызывающих самые токсичные онлайн-комментарии

❋ 4.7

Исследователи Высшей школы бизнеса НИУ ВШЭ создали модель, которая может автоматически выявлять токсичные комментарии, написанные на русском языке. Алгоритм определил их долю среди разных тем в социальной сети «Пикабу». Больше всего таких записей было под постами о политике, темы безопасности и социально-экономического развития заняли второе и третье места.

В НИУ ВШЭ построили рейтинг тем, вызывающих самые токсичные онлайн-комментарии / ©Getty images / Автор: Caristania Fabricius

Результаты работы опубликованы в сборнике IEEE International Conference on Business Informatics. Токсичная речь в онлайн-беседах может привести не только к негативным последствиям для психического здоровья, но и к насилию в реальном мире. Под токсичностью в интернете понимают грубый, неуважительный или необоснованный комментарий, который может заставить людей покинуть обсуждение или отказаться от того, чтобы делиться своей точкой зрения.

Ученые Высшей школы экономики изучили, какие темы вызывают наиболее острые комментарии, на примере социальной сети «Пикабу». Для этого была создана модель машинного обучения, которая способна автоматически определять токсичные комментарии на русском языке, а также разработана методология для категоризации постов по разным темам.

Исследователи отобрали корпус из 521 050 постов и 19 275 438 комментариев, размещенных в 2019 году. Для исследования были взяты темы, которые относятся к основным направлениям измерения субъективного благополучия: политика, здоровье, социально-экономическое развитие, безопасность, окружающая среда, возможности трудоустройства.

В отличие от предыдущих работ, ученые не только сосредоточились на тренировке модели, но и опробовали ее на практике. В рамках исследования была создана модель ToxicRuBERT-TPikabu, которая может автоматически определять токсичные комментарии, написанные на русском языке. Поскольку обучение подобных нейронных сетей требует значительного количества вычислительных мощностей, авторы исследования использовали суперкомпьютер НИУ ВШЭ.

«Для классификации токсичных комментариев мы вручную разметили набор данных через Yandex.Toloka и провели эксперименты по обучению классификаторов на основе языковых моделей RuBERT и ToxicRuBERT. В наших исследованиях по классификации токсичности и настроений в русскоязычных текстах эти модели демонстрировали более высокое качество классификации, чем другие», — рассказывает соавтор исследования, аспирант департамента бизнес-информатики Высшей школы бизнеса НИУ ВШЭ Сергей Сметанин.

Анализ постов «Пикабу» показал, что наибольшая доля токсичных комментариев была под постами о политике (вполне ожидаемо), темы безопасности и социально-экономического развития заняли второе и третье места, а остальные темы показали примерно одинаковые значения. «Будущие исследования могут быть связаны с изучением особенностей распространения токсичного контента. Некоторые исследования уже показывают, что такой стиль может быть заразным: грубость и неуважение к собеседнику со стороны одного пользователя приводят к тому, что и другие пользователи отвечают в схожем ключе», — рассказывает Сергей Сметанин. 

Нашли опечатку? Выделите фрагмент и нажмите Ctrl + Enter.
Национальный исследовательский университет «Высшая школа экономики» — один из крупнейших и самых востребованных вузов России. В университете учится 54 тысячи студентов и работает почти 4,5 тысячи учёных и преподавателей. НИУ ВШЭ ведёт фундаментальные и прикладные исследования в области социально-экономических, гуманитарных, юридических, инженерных, компьютерных, физико-математических наук, а также креативных индустрий. В университете действуют 47 центров превосходства, или международных лабораторий. Вышка объединяет ведущих мировых исследователей в области изучения мозга, нейротехнологий, биоинформатики и искусственного интеллекта. Университет входит в первую группу программы «Приоритет-2030» в направлении «Исследовательское лидерство». Кампусы НИУ ВШЭ расположены в четырех городах — Москве, Санкт-Петербурге, Нижнем Новгороде и Перми, а также в цифровом пространстве — «Вышка Онлайн».
Подписывайтесь на нас в Telegram, Яндекс.Новостях и VK
21 мая, 16:54
ЮФУ

Астрофизики Южного федерального университета предложили объяснение одной из самых интригующих загадок современной физики — годичных колебаний сигнала в детекторе DAMA/LIBRA, который вот уже почти тридцать лет регистрирует странные сигналы в подземной лаборатории Гран-Сассо в Италии, интерпретируемые как взаимодействие частиц темной материи с обычным веществом.

22 мая, 16:40
МГППУ

Чтение в дошкольном возрасте — это важная часть обучения, общения и воспитания. Оно помогает понимать смысл, задавать вопросы, удерживать внимание и постепенно входить в культуру общения с книгой. Кроме того, для маленького ребенка это новый способ взаимодействия с родителем. Сегодня эта тема особенно актуальна, потому что интерес детей к чтению снижается, а книги все чаще не выдерживают конкуренции с яркими видеоформатами. На рынке появляются книги с интерактивными элементами или элементами дополненной реальности: оживающие картинки, запахи, звуки.

24 мая, 13:31
Любовь С.

Ученые собрали одну из самых полных «карт» возможных следов внеземных цивилизаций — от загадочных объектов на земной орбите до гигантских мегаструктур вокруг звезд. Вместо ожидания радиосигнала авторы обзора предложили искать любые технологические отпечатки развитых цивилизаций, некоторые из которых могут сохраняться миллионы лет.

19 мая, 09:08
ИИМК РАН

Команда археологов в составе младшего научного сотрудника Отдела славяно-финской археологии ИИМК РАН Натальи Григорьевой и археозоологов Института экологии растений и животных УрО РАН Ольги Бачуры и Татьяны Лобановой завершила комплексное исследование коллекции костей животных из раскопок поселения на Земляном городище Старой Ладоги (Ленинградская область). В ходе работы удалось проследить изменения системы хозяйства жителей на протяжении почти 10 веков.

21 мая, 08:55
Максим Абдулаев

Палеонтологи выяснили, почему у тираннозавра и других крупных хищных динозавров были непропорционально маленькие передние лапы. Математическое моделирование показало, что редукция конечностей не была генетической ошибкой или побочным эффектом роста тела. В ходе эволюции челюсти и череп хищников стали настолько массивными и мощными, что полностью взяли на себя задачу по поимке и умерщвлению крупной добычи, из-за чего передние конечности атрофировались за ненадобностью.

19 мая, 10:33
НИТУ МИСИС

В России 19 мая отмечается День фармацевтического работника. В современном мире эта отрасль подвержена большим изменениям: аптеки уходят в онлайн, производство локализуется, а требования к лекарствам растут. Вместе с отраслью меняется и сама профессия провизора. О том, почему фармацевтика нуждается в новом типе специалиста и что для этого нужно сделать, рассказывает доктор экономических наук, директор Института экономики и управления НИТУ МИСИС Алексей Митенков.

17 мая, 10:35
Игорь Байдов

В высокогорных районах Гималаев появился новый хищник. Он не боится людей, возглавляет стаи собак и все чаще заходит в деревни. Местные жители называют его «кхипшанг». Речь идет о гибриде гималайского волка и бродячей собаки. Ученые опасаются, что этот зверь изменит хрупкий баланс местной дикой природы и в скором времени станет весьма опасным для человека.

29 апреля, 13:04
Александр Березин

Релиз довольно неожиданно перенес время образования протонов и нейтронов в более раннее прошлое Вселенной. К сожалению, из его текста осталось неясным научное обоснование таких фундаментальных изменений в космологии. Также он резко передвинул в прошлое и момент возникновения реликтового излучения.

17 мая, 10:00
Evgenia Vavilova

При совпадении нескольких условий наши глаза способны улавливать излучение в ближнем инфракрасном спектре. Тогда сетчатка начинает работать как нелинейный фотодетектор.

[miniorange_social_login]

Комментарии

29 Комментариев
НИУ ВШЭ. Куда уж токсичнее.
А вот и токсичные речи шовинистов, которые приводят их к "негативным последствиям для психического здоровья"...
Я уж было подумал что мои коменты провоцируют активность интернет-борцунков за свободы™, но не тут-то было - перестал заходить/отвечать, а ололошечки ринулись молотить по клавишам с удвоенной силой 🙄 и окончательно заспамили коменты. Раньше хоть на время уползали зализывать душевные раны 😁
-
3
+
Осталось только членораздельно рассказать, что же такое эта самая "токсичная речь"(ц).
"Токсичная речь в онлайн-разговорах должна рассматриваться как вопрос серьезной социальной значимости, поскольку она может привести как к негативным последствиям для психического здоровья, так и к насильственным действиям в физическом мире". В РФ насилие по результатам анализа текстов в интернете совершают в основном ФСБ, Следком, прокуратура и полиция, вот кто-то из них и был реальным заказчиком этого исследования под кодовым названием "Большой брат следит за тобой"...
Подтвердить?
Подтвердить?
Причина отклонения
Подтвердить?
Не получилось опубликовать!

Вы попытались написать запрещенную фразу или вас забанили за частые нарушения.

Понятно
Комментарий на проверке

Что-то в вашем комментарии показалось подозрительным, поэтому перед публикацией он пройдет модерацию.

Понятно
Жалоба отправлена

Мы обязательно проверим комментарий и
при необходимости примем меры.

Спасибо
Аккаунт заблокирован!

Из-за нарушений правил сайта на ваш аккаунт были наложены ограничения. Если это ошибка, напишите нам.

Понятно
Что-то пошло не так!

Наши фильтры обнаружили в ваших действиях признаки накрутки. Отдохните немного и вернитесь к нам позже.

Понятно
Лучшие материалы
Закрыть
Войти
Авторизуясь, вы даете согласие на обработку персональных данных и подтверждаете ознакомление с Политикой.
Ваша заявка получена

Мы скоро изучим заявку и свяжемся с Вами по указанной почте в случае положительного исхода. Спасибо за интерес к проекту.

Понятно