Перевод названия: REPRESENTATION MODELS OF TEXTS IN DATA ANALYSIS
Тип публикации: доклад, тезисы доклада, статья из сборника материалов конференций
Конференция: ИНФОРМАТИЗАЦИЯ ОБРАЗОВАНИЯ: ИСТОРИЯ, ПРОБЛЕМЫ И ПЕРСПЕКТИВЫ; Кызыл; Кызыл
Год издания: 2016
Ключевые слова: texts modeling, data analysis, natural language processing, моделирование текстов, анализ данных, обработка естественного языка
Аннотация: В статье разобраны основные модели представления текстов в анализе данных. Это «мешок слов», деревья синтаксического разбора, представление семантических отношений между предложениями текста, чаща разбора и семантико-коммуникативное представление текста. Каждая модель имеет свои области применения. «Мешок слов» используется в задачПоказать полностьюах информационного поиска, деревья синтаксического разбора - для обработки текстов на естественных языках. Особое внимание уделено моделям, применяемым в корпусах текстов. In article representation models of texts in the analysis of data are considered. It is a "bag of words", trees of syntactic analysis, representation of the semantic relations between offers of the text, thicket of analysis and semantic-communicative representation of the text. Each model has the purposes and features of application. "The bag of words" is used in problems of information search, trees of syntactic analysis is for processing of texts in natural languages. The special attention is paid to the models applied in corpuses.
Журнал: ИНФОРМАТИЗАЦИЯ ОБРАЗОВАНИЯ: ИСТОРИЯ, ПРОБЛЕМЫ И ПЕРСПЕКТИВЫ
Номера страниц: 81-84
Издатель: Федеральное государственное бюджетное образовательное учреждение высшего профессионального образования "Тувинский государственный университет"