Пожалуйста, используйте этот идентификатор, чтобы цитировать или ссылаться на этот ресурс: http://elar.urfu.ru/handle/10995/108729
Полная запись метаданных
Поле DCЗначениеЯзык
dc.contributor.authorZenkov, A.en
dc.contributor.authorZenkov, E.en
dc.contributor.authorZenkov, M.en
dc.date.accessioned2022-02-11T09:42:14Z-
dc.date.available2022-02-11T09:42:14Z-
dc.date.issued2022-
dc.identifier.citationZenkov A. Data Analysis on the Basis of Numerals Statistics / A. Zenkov, E. Zenkov, M. Zenkov // Российские регионы в фокусе перемен : сборник докладов в двух томах (18-20 ноября 2021 года, Екатеринбург). — Том 1. — Екатеринбург : УрФУ, 2022. — С. 412-415.en
dc.identifier.isbn978-5-91256-542-7-
dc.identifier.urihttp://elar.urfu.ru/handle/10995/108729-
dc.description.abstractTwo approaches to content analysis of text data are suggested, both based on the statistical study of numerals occurrence in texts. The first approach is related to counting the frequency distribution of various leading digits of numerals occurring in the text. These frequencies are unequal: the digit 1 is strongly dominating; usually, the incidence of subsequent digits is monotonically decreasing. The frequencies of occurrence of the digit 1, as well as, to a lesser extent, the digits 2 and 3, are usually a characteristic author's style feature, manifested in all (sufficiently long) literary texts of any author. This approach is convenient for testing whether a group of texts has common authorship: the latter is dubious if the frequency distributions are sufficiently different. The second approach is the extension of the first one and requires the study of the frequency distribution of numerals themselves (not their leading digits). The approach yields non-trivial information about the author, stylistic and genre peculiarities of the texts and is suited for the advanced stylometric analysis. The proposed approaches are illustrated by examples of computer analysis of the literary texts in Lithuanian – by S. Daukantas, A. Baranauskas, Maironis, and J. Tumas-Vaižgantas.en
dc.format.mimetypeapplication/pdfen
dc.language.isoenen
dc.publisherУрФУru
dc.relation.ispartofРоссийские регионы в фокусе перемен : сборник докладов. Том 1. — Екатеринбург, 2021ru
dc.subjectSTYLOMETRYen
dc.subjectQUANTITATIVE LINGUISTICSen
dc.subjectNUMERALSen
dc.subjectNUMERALS IN TEXTen
dc.subjectNUMERALS STATISTICSen
dc.subjectFIRST SIGNIFICANT DIGITen
dc.subjectLEADING DIGITen
dc.subjectBENFORD’S LAWen
dc.subjectTEXT PROCESSINGen
dc.subjectTEXT ATTRIBUTIONen
dc.subjectTEXT AUTHORSHIPen
dc.subjectTEXTUAL CRITICISMen
dc.subjectLITHUANIAN LITERATUREen
dc.subjectDAUKANTASen
dc.subjectBARANAUSKASen
dc.subjectMAIRONISen
dc.subjectTUMAS-VAIŽGANTASen
dc.titleData Analysis on the Basis of Numerals Statisticsen
dc.typeArticleen
dc.typeinfo:eu-repo/semantics/articleen
dc.typeinfo:eu-repo/semantics/publishedVersionen
dc.conference.nameXVI Международная конференция «Российские регионы в фокусе перемен»ru
dc.conference.date18.11.2021-20.11.2021-
local.description.firstpage412-
local.description.lastpage415-
Располагается в коллекциях:Междисциплинарные конференции, семинары, сборники

Файлы этого ресурса:
Файл Описание РазмерФормат 
978-5-91256-542-7_1_077.pdf569,71 kBAdobe PDFПросмотреть/Открыть


Все ресурсы в архиве электронных ресурсов защищены авторским правом, все права сохранены.