Модель автоматизированного извлечения компетентностной терминологии из текстов официально-делового дискурса
Модель автоматизированного извлечения компетентностной терминологии из текстов официально-делового дискурса
Статья посвящена автоматизированному извлечению терминологических выражений, обозначающих профессиональные компетенции, из текстов официально-делового дискурса в виде должностных инструкций и нормативных правовых актов. Цель исследования – разработать лингвистическую модель ранжирования терминоединиц, учитывающую частотность, длину и вложенность словосочетаний, а также их контекстную связанность с маркерами компетентностного высказывания. Методологической основой служат корпусный анализ профессионального подъязыка, отбор терминологических кандидатов по грамматическим шаблонам именных групп и количественная мера терминной значимости, объединяющая статистическую и контекстную составляющие в виде выпуклой комбинации. Контекстный канал параметризован весами предикатов «знать», «уметь», «владеть» и мерой их совместной встречаемости с кандидатом в окне заданного радиуса. Научная новизна состоит в формальном механизме учета вложенности многословных терминов, в параметризации контекстного канала и в проекции извлеченных выражений на типологию компетенций «знать», «уметь», «владеть» с онтологической трассировкой. Результаты показывают, что модель приоритизирует полные многословные термины, употребленные в функции требований, и отсекает семантически несамостоятельные фрагменты. Предложенный подход применим для формализации профессионального дискурса, построения отраслевых терминологических ресурсов и проектирования программ профессиональной языковой подготовки.
Батяй А. Н., Ваничкина А. С., Селиверстов Д. Е. Модель автоматизированного извлечения компетентностной терминологии из текстов официально-делового дискурса // Вопросы прикладной лингвистики. 2026. № 62. С. 35–63. https://doi.org/10.25076/vpl.62.02
Поступила в редакцию: 2.05.20206.
Доработана: 25.05.2026.
Принята к публикации: 17.06.2026.