Библиографическое описание:Bentz, Christian. Adaptive Languages : An Information-Theoretic Account of Linguistic Diversity / Christian Bentz. - Электрон. текстовые дан. - 1515/9783110560107. - Berlin ; Boston : Walter de Gruyter GmbH, 2018. - 1 online resource (233 p.). - Загл. с титул. экрана. - ISBN 9783110560107. - ISBN 3110560100 : Б. ц. - Текст : электронный. Перевод заглавия: Адаптивные языки : теоретико-информационный подход к языковому разнообразию Примечания о происхождении: Коллекция цифровых книг Ebsco ebook (централизованная подписка 2023 г., бессрочный доступ). НБ СФУ
Аннотация:Languages carry information. To fulfil this purpose, they employ a multitude of coding strategies. This book explores a core property of linguistic coding - called lexical diversity. Parallel text corpora of overall more than 1800 texts written in more than 1200 languages are the basis for computational analyses. Different measures of lexical diversity are discussed and tested, and Shannon's measure of uncertainty - the entropy - is chosen to assess differences in the distributions of words. To further explain this variation, a range of descriptive, explanatory, and grouping factors are considered in a series of statistical models. The first category includes writing systems, word-formation patterns, registers and styles. The second category includes population size, non-native speaker proportions and language status. Grouping factors further elicit whether the results extrapolate across - or are limited to - specific language families and areas. This account marries information-theoretic methods with a complex systems framework, illustrating how languages adapt to the varying needs of their users. It sheds light on the puzzling diversity of human languages in a quantitative, data driven and reproducible manner.
Языки несут в себе информацию. Для достижения этой цели они используют множество стратегий кодирования. В этой книге рассматривается ключевое свойство лингвистического кодирования, называемое лексическим разнообразием. Основой для компьютерного анализа являются параллельные текстовые массивы, состоящие в общей сложности из более чем 1800 текстов, написанных более чем на 1200 языках. Обсуждаются и тестируются различные показатели лексического разнообразия, и для оценки различий в распределении слов выбирается мера неопределенности Шеннона - энтропия. Для дальнейшего объяснения этого различия в ряде статистических моделей рассматривается ряд описательных, поясняющих и группирующих факторов. Первая категория включает системы письма, словообразовательные модели, регистры и стили. Вторая категория включает численность населения, соотношение лиц, не являющихся носителями языка, и статус языка. Группирующие факторы также определяют, распространяются ли результаты на конкретные языковые семьи и регионы или ограничиваются ими. В этой статье теоретико-информационные методы сочетаются со структурой сложных систем, иллюстрируя, как языки адаптируются к различным потребностям своих пользователей. Она проливает свет на загадочное разнообразие человеческих языков с точки зрения количественных показателей, управляемости данными и воспроизводимости.
Рубрики:Language Change and Evolution, Linguistic Adaptation, Quantitative Linguistic Typology, Word Entropy, Language and languages / Variation, Linguistic change, Word (Linguistics), FOREIGN LANGUAGE STUDY / Miscellaneous, LANGUAGE ARTS & DISCIPLINES / Linguistics / Semantics, LANGUAGE ARTS & DISCIPLINES / Reference