ailev.ru

26 февраля 2014 · Комментарий

Без заголовка

Я думаю, что "глоссарная составляющая" (мультиязычная, с толкованиями) должна быть составной частью Reference Data Library. Вообще, тут три дисциплины: -- моделирование данных, как в Kimball «Data Warehouse Toolkit» и у всей остальной датабазной тусовки -- тезаурусы и далее по лингвистической линии моделирования понятий (WordNet и прочие) -- онтологическая линия (ISO 15926, DOLCHE, COSMO и т.д.). По замыслу Ontology Summit 2014 мы должны навести мосты между разными комьюнити (в частности, между датабазным моделированием данных и онтологическим моделированием), что непосредственно является целью проекта. Т.е. мы понимаем, что исходные данные у нас сделаны датабазно, а конечные данные у нас будут онтологичны. Предложение сделать "словари сленга" неминуемо залезает и в лингвистические комьюнити с их пониманием "широты-узины понятий" (в отличие от "общности-специализации понятий" в онтологической парадигме). Вся эта работа не на leading edge, а на bleeding edge, ещё более переднекраевая, чем может показаться. Завтра будет доклад по проекту онтологической тусовке: http://ontolog.cim3.net/cgi-bin/wiki.pl?ConferenceCall_2014_02_27, прямо первым номером в программе.

К записи · К обсуждению