Уведомления
Авторизуйтесь или зарегистрируйтесь, чтобы оценивать материалы, создавать записи и писать комментарии.
Авторизуясь, вы соглашаетесь с правилами пользования сайтом и даете согласие на обработку персональных данных.
Искусственный интеллект распознал изображения хуже, чем человек
У компьютерного зрения нет тех физиологических особенностей, которые есть у человека, поэтому оно хуже распознает изображения. К такому выводу пришли ученые из ВШЭ и Московского политехнического университета.
Результаты исследования опубликованы в сборнике Proceedings of Seventh International Congress on Information and Communication Technology. Чтобы понять, как машинное восприятие изображений отличается от человеческого, российские ученые загрузили изображения классических визуальных иллюзий в онлайн-сервис распознавания образов IBM Watson Visual Recognition. Большая часть из них представляла собой геометрические силуэты, частично скрытые геометрическими формами цвета заднего плана. Система пыталась определить, что представляет собой поступившее изображение, и указывала степень уверенности в своем ответе.
Оказалось, что искусственный интеллект не способен распознать ни одну воображаемую фигуру. Исключение составил раскрашенный воображаемый треугольник. В силу высокого контраста с фоном он был распознан правильно.
«Объекты, похожие на те, что мы использовали в ходе эксперимента, встречаются в реальной жизни, — комментирует автор исследования Владимир Винников, аналитик Научно-учебной лаборатории методов анализа больших данных факультета компьютерных наук ВШЭ. — Например, прицеп трейлера или радиобашня, которые по ночам обозначаются только габаритными огнями, автопилот автомобиля или самолета воспринимает таким же образом, как мы — воображаемые геометрические фигуры».
Человеческий глаз постоянно непроизвольно движется, а светочувствительная поверхность его сетчатки имеет форму полусферы. Чтобы человек увидел иллюзию, изображению достаточно быть векторным — состоять из опорных точек и соединяющих их кривых. Человеческое воображение достроит картинку благодаря физиологической особенности зрения — постоянному движению глаз.
В оптико-электронных системах все устроено иначе. Их светочувствительная матрица имеет плоскую, как правило прямоугольную, форму, а сама система линз далеко не так свободна в движении, как человеческий глаз. Поэтому искусственный интеллект не может достроить воображаемые линии, которые связывают фрагменты геометрической иллюзии. Машинное зрение видит только то, что реально изображено, тогда как человек достраивает в воображении полное изображение по его очертаниям.
Нейросетевые системы распознавания образов сегодня активно распространяются в коммерческом секторе. Однако вопрос, насколько точно машина распознает изображение, до сих остается открытым. От точности его распознавания могут зависеть человеческие жизни. Например, если автопилот автомобиля или самолета не распознает объект с низкой контрастностью относительно фона и не успеет вовремя уклониться от препятствия, может произойти катастрофа.
Ученые полагают, что недостатки машинного распознавания образов можно исправить. Например, дополнить распознавание растровых изображений, представляющих собой сетку пикселей, имитацией физиологических особенностей движения глаз, которые позволяют глазу видеть двумерные и трехмерные сцены. Альтернативный способ — добавить векторное описание изображений. Оно позволит запрограммировать машину на обход изображения по траекториям, заданным векторами.
«Воображаемые фигуры обязательно стоит использовать в качестве тестов в системах, которые зависят от распознавания фото- и видеопотоков. Например, в автопилотах машин или беспилотных летательных аппаратов. Это поможет избежать рисков, связанных с использованием систем машинного интеллекта в промышленности и транспортных системах», — полагает Владимир Винников.
Ученые определили, что люди, населявшие Центральный Кавказ 18–10 тысяч лет назад, использовали для создания орудий охоты камень обсидиан из единственного месторождения — Заюковского. При этом другое популярное сырье — кремень — они добывали из десяти разных источников. Оказалось, что за кремнем оранжевого цвета древним охотникам приходилось путешествовать на расстояния более 200 километров, что указывает на наличие культурных связей с соседними регионами, где в этот период были распространены стоянки той же культурной традиции.
Со временем одни воспоминания заменяются другими, но почему люди запоминают именно то, что запоминают? На этот вопрос ответили ученые из США, проанализировав более 100 исследований эпизодической памяти.
Одни из самых ярких объектов во Вселенной — квазары — представляют собой активные ядра галактик, питаемые центральными сверхмассивными черными дырами. Электромагнитное излучение, испускаемое этими объектами, позволяет астрономам изучать структуру Вселенной на ранних этапах ее развития, однако мощный радиоджет, исходящий от недавно обнаруженного экстремально яркого квазара J1601+3102, ставит под сомнение существующие представления о «космической заре».
Ученые определили, что люди, населявшие Центральный Кавказ 18–10 тысяч лет назад, использовали для создания орудий охоты камень обсидиан из единственного месторождения — Заюковского. При этом другое популярное сырье — кремень — они добывали из десяти разных источников. Оказалось, что за кремнем оранжевого цвета древним охотникам приходилось путешествовать на расстояния более 200 километров, что указывает на наличие культурных связей с соседними регионами, где в этот период были распространены стоянки той же культурной традиции.
Со временем одни воспоминания заменяются другими, но почему люди запоминают именно то, что запоминают? На этот вопрос ответили ученые из США, проанализировав более 100 исследований эпизодической памяти.
Уникальный артефакт возрастом более 3600 лет считают древнейшим точным изображением неба в истории человечества. Ученые много лет задаются вопросом, как в бронзовом веке удалось создать настолько искусный образец художественной ковки. Чтобы разобраться в этом, они попросили опытных мастеров изготовить копии этого небесного диска.
Международная коллаборация физиков под руководством ученых из Йельского университета в США представила самые убедительные на сегодня подтверждения существования нового типа сверхпроводящих материалов. Доказательство существования нематической фазы вещества — научный прорыв, открывающий путь к созданию сверхпроводимости совершенно новым способом.
Обсерватории постоянно улавливают «мигающие» радиосигналы из глубин Вселенной. Чаще всего их источниками оказываются нейтронные звезды, которые за это и назвали пульсарами. Но к недавно обнаруженному источнику GLEAM-X J0704-37 они, по мнению астрономов, отношения не имеют.
Многие одинокие люди считают, что окружающие не разделяют их взглядов. Психологи из США решили проверить, так ли это на самом деле, и обнаружили общую особенность у людей с недостаточным количеством социальных связей.
Вы попытались написать запрещенную фразу или вас забанили за частые нарушения.
ПонятноИз-за нарушений правил сайта на ваш аккаунт были наложены ограничения. Если это ошибка, напишите нам.
ПонятноНаши фильтры обнаружили в ваших действиях признаки накрутки. Отдохните немного и вернитесь к нам позже.
ПонятноМы скоро изучим заявку и свяжемся с Вами по указанной почте в случае положительного исхода. Спасибо за интерес к проекту.
ПонятноМы скоро прочитаем его и свяжемся с Вами по указанной почте. Спасибо за интерес к проекту.
Понятно
Комментарии