ПРИМЕНЕНИЕ ДИСТРИБУТИВНОЙ СЕМАНТИКИ ПРИ ВЫДЕЛЕНИИ ЗНАЧИМЫХ СОЧЕТАНИЙ ЗАГОЛОВКОВ НЕСКОЛЬКИХ КОЛЛЕКЦИЙ ТЕКСТОВ ПРИ ФОРМАЛИЗАЦИИ ЛИНГВИСТИЧЕСКОЙ ЭКСПЕРТНОЙ ИНФОРМАЦИИ
Аннотация
Рассматриваются методы формирования специальных моделей представления раз- личных наборов знаний в различных информационных системах. Работа посвящена приме- нению дистрибутивной семантики при выделении значимых сочетаний в одной предмет- ной области (ПрО) в рамках формализации лингвистической экспертной информации (ЛЭИ). В работе применяется подход к формализации ЛЭИ на основе набора аналитиче- ских методов, где в качестве моделей используется линейная алгебра. Такой подход даетархитектур ЛЭИ или дендрограмм при выделении значимых сочетаний заголовков несколь- ких коллекций текстов. Научная новизна заключается в предложенном аналитическом подходе с применением дистрибутивной семантики при выделении значимых сочетаний заголовков нескольких коллекций текстов, который позволяет проводить анализ и обра- ботку лингвистической экспертной информации. Отличительной характеристикой пред- ложенного подхода является возможность формализовать ПрО «Методы глобальной оп- тимизации» на основе синтеза различных уже существующих иерархий рассматриваемой ПрО. В работе преследуется задача создать условия для формализации ЛЭИ путем приме- нения дистрибутивной семантики при выделении значимых сочетаний заголовков несколь- ких коллекций. Практическая ценность работы заключается в разработке нового подхода в формализации ЛЭИ с учетом дистрибутивной семантики при выделении значимых соче- таний заголовков нескольких коллекций текстов. Так же в работе построена онтология в owl формате «Методы глобальной оптимизации» в программе «Protege». Онтология по- строена на основе связанных данных ПрО. Построенная в данной работе онтология, до- полняет структуру поиска в рамках рассматриваемой ПрО и может быть дополнена и развита в дальнейшем.








