Уведомления
Авторизуйтесь или зарегистрируйтесь, чтобы оценивать материалы, создавать записи и писать комментарии.
Авторизуясь, вы соглашаетесь с правилами пользования сайтом и даете согласие на обработку персональных данных.
В НИУ ВШЭ построили рейтинг тем, вызывающих самые токсичные онлайн-комментарии
Исследователи Высшей школы бизнеса НИУ ВШЭ создали модель, которая может автоматически выявлять токсичные комментарии, написанные на русском языке. Алгоритм определил их долю среди разных тем в социальной сети «Пикабу». Больше всего таких записей было под постами о политике, темы безопасности и социально-экономического развития заняли второе и третье места.
Результаты работы опубликованы в сборнике IEEE International Conference on Business Informatics. Токсичная речь в онлайн-беседах может привести не только к негативным последствиям для психического здоровья, но и к насилию в реальном мире. Под токсичностью в интернете понимают грубый, неуважительный или необоснованный комментарий, который может заставить людей покинуть обсуждение или отказаться от того, чтобы делиться своей точкой зрения.
Ученые Высшей школы экономики изучили, какие темы вызывают наиболее острые комментарии, на примере социальной сети «Пикабу». Для этого была создана модель машинного обучения, которая способна автоматически определять токсичные комментарии на русском языке, а также разработана методология для категоризации постов по разным темам.
Исследователи отобрали корпус из 521 050 постов и 19 275 438 комментариев, размещенных в 2019 году. Для исследования были взяты темы, которые относятся к основным направлениям измерения субъективного благополучия: политика, здоровье, социально-экономическое развитие, безопасность, окружающая среда, возможности трудоустройства.
В отличие от предыдущих работ, ученые не только сосредоточились на тренировке модели, но и опробовали ее на практике. В рамках исследования была создана модель ToxicRuBERT-TPikabu, которая может автоматически определять токсичные комментарии, написанные на русском языке. Поскольку обучение подобных нейронных сетей требует значительного количества вычислительных мощностей, авторы исследования использовали суперкомпьютер НИУ ВШЭ.
«Для классификации токсичных комментариев мы вручную разметили набор данных через Yandex.Toloka и провели эксперименты по обучению классификаторов на основе языковых моделей RuBERT и ToxicRuBERT. В наших исследованиях по классификации токсичности и настроений в русскоязычных текстах эти модели демонстрировали более высокое качество классификации, чем другие», — рассказывает соавтор исследования, аспирант департамента бизнес-информатики Высшей школы бизнеса НИУ ВШЭ Сергей Сметанин.
Анализ постов «Пикабу» показал, что наибольшая доля токсичных комментариев была под постами о политике (вполне ожидаемо), темы безопасности и социально-экономического развития заняли второе и третье места, а остальные темы показали примерно одинаковые значения. «Будущие исследования могут быть связаны с изучением особенностей распространения токсичного контента. Некоторые исследования уже показывают, что такой стиль может быть заразным: грубость и неуважение к собеседнику со стороны одного пользователя приводят к тому, что и другие пользователи отвечают в схожем ключе», — рассказывает Сергей Сметанин.
«Яндекс» внедряет нейросетевые технологии с 2010-х годов — этому предшествовало много лет исследований в сфере машинного обучения. Со временем такие разработки сделали сервисы компании удобнее и быстрее: например, сегодня пользователи «Поиска» получают более подробные ответы на свои запросы, в которых могут комбинировать текст и изображение.
В России создают новые источники микроволнового излучения, изучают сложные квантовые эффекты в полупроводниках, исследуют свойства вещества при сверхвысоких давлениях и многое другое. В этом небольшом тексте мы не сможем затронуть все проводимые исследования в такой большой стране, как наша, и даже упомянуть все институты и университеты, которые ими заняты — но попробуем наметить основные тенденции.
О развитии отечественного приборостроения и перспективах российской микроэлектроники мы поговорили с Виктором Ивановым, член-корреспондентом РАН, директором Института квантовых технологий МФТИ
Американская лунная программа «Артемида» предусматривает экспедиции длительностью от нескольких дней до долгих недель и даже месяцев, но луномобиля для передвижения экипажа по поверхности спутника Земли на сегодня нет. Поэтому космическое агентство США продумывает план действий на случай, если астронавты окажутся далеко от базы и кто-то из них внезапно не сможет идти самостоятельно.
Сражались ли амазонки на территории нашей страны, как развивались первые крупные города и чем древний геном выносливее современного — об этом нам рассказал Харис Мустафин, заведующий лабораторией исторической генетики, радиоуглеродного анализа и прикладной физики МФТИ.
Последние полвека темпы развития науки снижаются. В быту это пока незаметно, потому что от фундаментального открытия до его реализации в технике проходят десятки лет. Но замедление длится слишком долго, то есть вскоре мы столкнемся с замедлением развития техники в целом. Naked Science решил дать перевод видео физика и популяризатора Сабины Хоссенфельдер на эту тему. Что же не так с современной наукой и можно ли что-то исправить?
Международная коллаборация физиков под руководством ученых из Йельского университета в США представила самые убедительные на сегодня подтверждения существования нового типа сверхпроводящих материалов. Доказательство существования нематической фазы вещества — научный прорыв, открывающий путь к созданию сверхпроводимости совершенно новым способом.
Обсерватории постоянно улавливают «мигающие» радиосигналы из глубин Вселенной. Чаще всего их источниками оказываются нейтронные звезды, которые за это и назвали пульсарами. Но к недавно обнаруженному источнику GLEAM-X J0704-37 они, по мнению астрономов, отношения не имеют.
Многие одинокие люди считают, что окружающие не разделяют их взглядов. Психологи из США решили проверить, так ли это на самом деле, и обнаружили общую особенность у людей с недостаточным количеством социальных связей.
сайт превращается в бандерложью помойку с кривляющимися кретинамиТы снова очень точно описал вашу шоблу и то, что вы хотите сделать из сайта.
будет ли сегодняшний "человек ленивый" за просто так годами(!) унижать и оплёвывать другого если у него нет личной заинтересованности?И тут сразу вспоминаются отважные интернет-воевошки, храбро копротивляющиеся против свободы, демократии, сказочной страны Запад™ и вообще всего, на что им указывают их духовненькие лидерки.
на ненавистное имя, отважно навалила кучку "своих" духовных "ценностей" под словами ненавистного врагаКак наверное одинок этот чудак. На любовь явно уже не рассчитывает, но мечтает вызвать хотя бы ненависть у никнеймов в интернетах. А ведь не старый еще дяденька. Неужто все вот так плохо?
Ну вот лежит какашка на дороге тоже лично никого не трогает но воняет.Вы тут своим специфическим запахом куда заметнее. Донда вас, шовинистов, просто троллит, а вы то всерьез с ним пытаетесь бороться, и в этот момент начинаете еще и выглядеть очень глупо... Чего он и добивается.
Да Лева спасибо ты указал мое слабое место.Иван, вы очень непонятливы -- Донда, похоже, набирает материал, проверяя какую-то свою теорию различий в реакциях людей с коллективистским сознанием на самые простые стимулы... Вы даете ему самый обширный материал...
Чего он и добивается.Ну вот меня и спалили. :-))) А так-то да, я недолюбливаю национально обиженных, зато мне нравится причинять им аршеншмерц.
Ну вот лежит какашка на дороге тоже лично никого не трогает но воняет.Ты очень точно описал самого себя.
идейно близкое дерьмо для тебя благоухает как розС вашей братией дело обстоит именно так.
объёмное но пустое перебрасывание шаблонных обвинений,Кстати, по-русски правильнее писать "шаблонными обвинениями".
равнодушному к любым проблемам плебса правительству (в широком смысле слова) тошно делается"Как это верно, Ватсон!" И от того оно заказывает такие исследования и применяет их результаты в репрессивных целях... ))
про шрапнель в Хаймарсах(U+2122) - Вы что думаете?Это вопрос к А. Березину...
будет ли сегодняшний "человек ленивый" за просто так годами(!) унижать и оплёвывать другого если у него нет личной заинтересованности?И тут сразу вспоминаются отважные интернет-воевошки, храбро копротивляющиеся против свободы, демократии, сказочной страны Запад™ и вообще всего, на что им указывают их духовненькие лидерки.
на ненавистное имя, отважно навалила кучку "своих" духовных "ценностей" под словами ненавистного врагаКак наверное одинок этот чудак. На любовь явно уже не рассчитывает, но мечтает вызвать хотя бы ненависть у никнеймов в интернетах. А ведь не старый еще дяденька. Неужто все вот так плохо?
Ну вот лежит какашка на дороге тоже лично никого не трогает но воняет.Вы тут своим специфическим запахом куда заметнее. Донда вас, шовинистов, просто троллит, а вы то всерьез с ним пытаетесь бороться, и в этот момент начинаете еще и выглядеть очень глупо... Чего он и добивается.
Да Лева спасибо ты указал мое слабое место.Иван, вы очень непонятливы -- Донда, похоже, набирает материал, проверяя какую-то свою теорию различий в реакциях людей с коллективистским сознанием на самые простые стимулы... Вы даете ему самый обширный материал...
Чего он и добивается.Ну вот меня и спалили. :-))) А так-то да, я недолюбливаю национально обиженных, зато мне нравится причинять им аршеншмерц.
Ну вот лежит какашка на дороге тоже лично никого не трогает но воняет.Ты очень точно описал самого себя.
идейно близкое дерьмо для тебя благоухает как розС вашей братией дело обстоит именно так.
объёмное но пустое перебрасывание шаблонных обвинений,Кстати, по-русски правильнее писать "шаблонными обвинениями".
равнодушному к любым проблемам плебса правительству (в широком смысле слова) тошно делается"Как это верно, Ватсон!" И от того оно заказывает такие исследования и применяет их результаты в репрессивных целях... ))
про шрапнель в Хаймарсах(U+2122) - Вы что думаете?Это вопрос к А. Березину...
сайт превращается в бандерложью помойку с кривляющимися кретинамиТы снова очень точно описал вашу шоблу и то, что вы хотите сделать из сайта.
Вы попытались написать запрещенную фразу или вас забанили за частые нарушения.
ПонятноИз-за нарушений правил сайта на ваш аккаунт были наложены ограничения. Если это ошибка, напишите нам.
ПонятноНаши фильтры обнаружили в ваших действиях признаки накрутки. Отдохните немного и вернитесь к нам позже.
ПонятноМы скоро изучим заявку и свяжемся с Вами по указанной почте в случае положительного исхода. Спасибо за интерес к проекту.
ПонятноМы скоро прочитаем его и свяжемся с Вами по указанной почте. Спасибо за интерес к проекту.
Понятно
Комментарии