دانلود مقاله انگلیسی رایگان:داده کاوی زبانی با شبکه های پیچیده: یک رویکرد استایلومتری گرا - 2019
بلافاصله پس از پرداخت دانلود کنید
دانلود مقاله انگلیسی داده کاوی رایگان
  • Linguistic data mining with complex networks: A stylometric-oriented approach Linguistic data mining with complex networks: A stylometric-oriented approach
    Linguistic data mining with complex networks: A stylometric-oriented approach

    سال انتشار:

    2019


    عنوان انگلیسی مقاله:

    Linguistic data mining with complex networks: A stylometric-oriented approach


    ترجمه فارسی عنوان مقاله:

    داده کاوی زبانی با شبکه های پیچیده: یک رویکرد استایلومتری گرا


    منبع:

    Sciencedirect - Elsevier - Information Sciences, 482 (2019) 301-320: doi:10:1016/j:ins:2019:01:040


    نویسنده:

    Tomasz Stanisz a , Jarosław Kwapie ´n a , Stanisław Dro ˙zd ˙z a , b , ∗


    چکیده انگلیسی:

    By representing a text by a set of words and their co-occurrences, one obtains a word- adjacency network being a reduced representation of a given language sample. In this pa- per, the possibility of using network representation to extract information about individual language styles of literary texts is studied. By determining selected quantitative charac- teristics of the networks and applying machine learning algorithms, it is possible to dis- tinguish between texts of different authors. Within the studied set of texts, English and Polish, a properly rescaled weighted clustering coefficients and weighted degrees of only a few nodes in the word-adjacency networks are sufficient to obtain the authorship attri- bution accuracy over 90%. A correspondence between the text authorship and the word- adjacency network structure can therefore be found. The network representation allows to distinguish individual language styles by comparing the way the authors use particular words and punctuation marks. The presented approach can be viewed as a generalization of the authorship attribution methods based on simple lexical features. Additionally, other network parameters are studied, both local and global ones, for both the unweighted and weighted networks. Their potential to capture the writing style diversity is discussed; some differences between languages are observed.
    Keywords: Complex networks | Natural language | Data mining | Stylometry | Authorship attribution


    سطح: متوسط
    تعداد صفحات فایل pdf انگلیسی: 20
    حجم فایل: 3550 کیلوبایت

    قیمت: رایگان


    توضیحات اضافی:




اگر این مقاله را پسندیدید آن را در شبکه های اجتماعی به اشتراک بگذارید (برای به اشتراک گذاری بر روی ایکن های زیر کلیک کنید)

تعداد نظرات : 0

الزامی
الزامی
الزامی
rss مقالات ترجمه شده rss مقالات انگلیسی rss کتاب های انگلیسی rss مقالات آموزشی
logo-samandehi