Статистическая атрибуция текстов (на примере десятой главы «Евгения Онегина»)
2002-е заседание.
-
А.П. Ковалевский
Статистическая атрибуция текстов (на примере десятой главы «Евгения Онегина»)
Статистические методы атрибуции текста бурно развиваются в последние годы. Метод авторского инварианта и метод дельты Бёрроуза используют частоты появления слов в тексте. Статистика Хмелёва основана на анализе частот появления сочетаний букв, в ее основе лежит модель цепи Маркова. Эти методы применяются к восьми главам “Евгения Онегина” и трем реконструкциям десятой главы. По результатам исследования создан пакет прикладных программ, позволяющий анализировать близость текстов по перечисленным критериям и предлагать варианты атрибуции на основании библиотеки авторов. Соавторы: Е.А. Булгакова, Б.Т. Бэк, В.Е. Веселов, Р.С. Ишков, А.П. Ковалевский, Т.Р. Куснатдинов, А.Е. Лукьянов, А.С. Попов, Т.В. Прасолов, Е.Н. Савинкина, А.А. Тарасенко, А.С. Тарасенко, П.И. Тесемников, Т.В. Ускова, Д.Ю. Цыбульский, А.А. Шмаков
Источник: Объединенный семинар «Вероятность и математическая статистика»