ailev.ru

10 июля 2017 · Комментарий

Без заголовка

Не видел, знакома ли Вам эта информация https://www.osp.ru/os/2017/01/13051588/ Математики нашли способ сжимать Большие Данные 10.03.2017 Ученые Лаборатории искусственного интеллекта МТИ и Хайфского университета разработали метод поиска подмножеств, сохраняющих ключевые математические отношения своих источников — огромных срезов данных. Способ отличается универсальностью и применимостью в широком круге областей, включая анализ текстов на естественном языке, машинное зрение, обработку сигналов, системы выдачи рекомендаций, прогнозирование погоды, финансовую аналитику, нейробиологию и др. Метод основан на геометрической интерпретации данных — представлении их в виде гиперсферы и поиске средних значений в подмножествах. Репрезентативность выбранных подмножеств исследователи доказывают математически. Действуя по принципу понижения размерности, метод позволяет радикально уменьшить затраты на анализ разреженных данных с помощью широко применяемых методик, таких как латентно-семантический анализ, метод главных компонент и др. Ученые показали действенность своего метода на примере матрицы, устанавливающей соответствие между статьями англоязычной «Википедии» и используемыми в них словами.

К записи · К обсуждению