Автоматическая обработка символьной информации. Автоматизация анализа массивов текстовых документов в информационно-коммуникационных средах.

📖 Автоматическая обработка символьной информации. Автоматизация анализа массивов текстовых документов в информационно-коммуникационных средах.

Данная работа посвящена проблемам разработки лингвистического и алгоритмического обеспечения, служащего для создания современной системы извлечения ключевой содержательной информации посредством применения широкого класса математических и лингвистических методов логико-аналитической обработки больших символьных массивов. В рамках данного исследования разработана обобщенная схема обработки массива публицистических текстов для подъязыка СМИ, выявлены тенденции с учетом соответствия результатов обработки естественно-языкового текста, выполненной компьютером и человеком, предложена модель текста как композиция формальных моделей ее компонентов, в основе которой лежит интеграция статистических и формальных лингвистических методов, разработан алгоритм извлечения элементов смысла из массива текстов ограниченной тематики, включающий блок первичной семантической обработки, блок индексации и ранжирования понятий, блок установления связей, блок выявления тематического узла, блок установления попарной встречаемости, блок построения семантической сети, блок синтеза информации из сети.

О книге

автор, издательство, серия
Издательство
LAP LAMBERT Academic Publishing
ISBN
978-3-843-31848-8
Год
2011