ailev.ru

10 января 2016 · Комментарий

Без заголовка

Наскок там совершенно не кавалерийский, об этом и пост. Ну, и одна сетка примерно равна одному человеку -- моделируем-то не человечество в целом, включая вкраплённых в человечество сумасшедших, плохо говорящих и понимающих и учёных какой-то секты/школы. Выход на уровень понимания текста (именно понимания, а не механической подстановки слов) какого-нибудь подростка это и есть цель исследований. Чтобы дальше продолжать, нужно разобраться, какие виды представлений языка бывают и их особенности. Ибо тут я цеплял в посте только word embeddings, но есть вариант уже и побуквенной работы. И замешивания картинок с текстами (там много лучше получается, чем чисто с текстами). Основная пока проблема тут -- дорогие алгоритмы по памяти и скорости, но и эту проблему быстро-быстро решают.

К записи · К обсуждению