Electronic supplementary materials Elektronische Begleitmaterialien Электронные материалы

Datensätze, R-Code, Korpusabfragen und weitere Materialien zur Dissertation:

Fisun, Roman (2026): Zusammengesetzte Indefinitpronomen in den slavischen Sprachen. Universität Regensburg.

Die Dateien enthalten die Daten und den Code, auf denen die Analysen der Dissertation beruhen. Im Text der Arbeit wird jeweils auf die einschlägigen Materialien verwiesen.

Данные, код R, корпусные запросы и другие материалы к диссертации:

Fisun, Roman (2026): Zusammengesetzte Indefinitpronomen in den slavischen Sprachen. Universität Regensburg.

Здесь собраны данные и код, на которых основаны анализы в диссертации. Ссылки на конкретные материалы даны в соответствующих разделах работы.

Data, R code, corpus queries, and other materials accompanying the dissertation:

Fisun, Roman (2026): Zusammengesetzte Indefinitpronomen in den slavischen Sprachen. University of Regensburg.

This page brings together the data and code used in the dissertation. The relevant materials are cited in the corresponding sections of the study.

Semantic maps Semantische Karten Семантические карты

Vollständige Datensätze der Karten, quantitative Kontextdaten, R-Code zur Bestimmung der Kartenstruktur und Ergebnisse der Netzwerkanalyse. Полные данные карт, количественные данные по контекстам, код для расчета структуры карты и результаты сетевого анализа. Full map datasets, quantitative context data, code for calculating the map structure, and results of the network analysis.

semantic_maps_1.xlsx

Vollständiger Datensatz für die semantisch-distributionellen Karten des Typs I. Полный набор данных для семантико-дистрибутивных карт типа I. Full dataset for the type I semantic-distributional maps.

semantic_maps_2.xlsx

Vollständiger Datensatz für die semantisch-distributionellen Karten des Typs II. Полный набор данных для семантико-дистрибутивных карт типа II. Full dataset for the type II semantic-distributional maps.

contexts_map1.xlsx

Vollständige quantitative Matrix für alle Reihen und Kontexte der Karten des Typs I. Die Tabelle enthält außerdem die berechneten SKAI-Werte. Полная количественная матрица для всех серий и контекстов карт типа I. В таблице также приведены рассчитанные значения SKAI. Complete quantitative matrix for all series and contexts in the type I maps. The table also contains the calculated SKAI values.

contexts_map2.txt

Liste der Kontexttypen, die für die Karten des Typs II verwendet werden. Список типов контекстов, используемых в картах типа II. List of the context types used in the type II maps.

map_configuration.R

R-Code zur Bestimmung einer möglichst sparsamen Kartenkonfiguration und der dafür erforderlichen Kanten. Код R для поиска наиболее компактной конфигурации карты и необходимых для нее связей. R code for finding a parsimonious map configuration and the edges required to connect it.

semantic_map_network_analysis.xlsx

Ergebnisse der Netzwerkanalyse und der Berechnung der Kartenkonfiguration. Результаты сетевого анализа и расчета конфигурации карты. Results of the network analysis and the calculation of the map configuration.

primitiva.html

Dreisprachiger Überblick über die Funktionen, Kontexte und Quelltypen der Karten. Трехъязычный справочник по функциям, контекстам и типам источников карт. Trilingual guide to the functions, contexts, and source types used in the maps.

Cluster analyses Clusteranalysen Кластерный анализ

Datenmatrizen und R-Code für die in Kapitel 11 beschriebenen Clusteranalysen. Матрицы данных и код R для кластерного анализа, описанного в главе 11. Data matrices and R code for the cluster analyses described in Chapter 11.

cluster_context.zip

Datenmatrizen und R-Code für die Clusteranalysen der Kontextprofile der Karten des Typs I und II. Матрицы данных и код R для кластерного анализа контекстных профилей карт типов I и II. Data matrices and R code for clustering the context profiles of type I and type II maps.

cluster_function.zip

Datenmatrix und R-Code für die Clusteranalyse der 51 Reihen nach ihren semantischen Funktionen. Матрица данных и код R для кластерного анализа 51 серии по семантическим функциям. Data matrix and R code for clustering the 51 series by their semantic functions.

Corpus queries Korpusabfragen Корпусные запросы

Allgemeine und reihenspezifische CQL-Abfragen für die Analyse der Verwendungskontexte. Общие и отдельные CQL-запросы для анализа контекстов употребления. General and series-specific CQL queries used to analyse contexts of use.

allgemeine_abfragen.html

Kommentierte Übersicht über die allgemeinen CQL-Abfragen. Общие CQL-запросы с краткими пояснениями. Commented overview of the general CQL queries.

alle_abfragen_context.zip

Vollständige Sammlung der allgemeinen und reihenspezifischen Abfragen für die Kontextanalyse. Полный набор общих запросов и запросов для отдельных серий, использованных при анализе контекстов. Complete collection of general and series-specific queries used in the context analysis.

anhang_freq_filter.html

Dokumentation spezifischer Filter sowie manueller Stichproben und Extrapolationen für Reihen, deren Frequenzbestimmung aufgrund erheblichen Datenrauschens oder zahlreicher homonymer Quellkonstruktionen zusätzliche Maßnahmen erforderte. Документация специальных фильтров, ручных выборок и экстраполяций для серий, определение частотности которых требовало дополнительных мер из-за значительного шума в данных или большого числа омонимичных исходных конструкций. Documentation of specific filters, manual samples, and extrapolations for series whose frequency calculation required additional measures because of substantial data noise or numerous homonymous source constructions.

Modifiers and grammaticalization Modifikatoren und Grammatikalisierung Модификаторы и грамматикализация

Daten zu den Modifikatoren, ihren Grammatikalisierungswerten, Frequenzen und etymologischen Typen. Данные о модификаторах, степени их грамматикализации, частотности и этимологических типах. Data on the modifiers, their grammaticalization scores, frequencies, and etymological types.

slavic_indefinite_modifiers.zip

Vollständiger Datensatz aller identifizierten Modifikatoren im Russischen, Ukrainischen, Polnischen, Tschechischen und Kroatischen. Das Archiv enthält die Gesamtübersicht, die Bewertungen aller Grammatikalisierungskriterien, die ursprünglichen Annotationen und ein Codebuch. Полный набор данных по всем выявленным модификаторам в русском, украинском, польском, чешском и хорватском языках. В архив входят общая таблица, оценки по всем критериям грамматикализации, исходные аннотации и описание переменных. Full dataset of all modifiers identified in Russian, Ukrainian, Polish, Czech, and Croatian. The archive contains the main table, scores for all grammaticalization criteria, the original annotations, and a codebook.

gramscore_all_ipm.txt

Übersicht über den Grammatikalisierungswert jeder Reihe, die sechs Parameter nach Lehmann, Position, Status, Korpusfrequenz und Frequenz pro Million Wörter. Таблица с общей оценкой грамматикализации каждой серии, шестью параметрами по Леману, позицией, статусом, корпусной частотой и частотой на миллион слов. Table with the overall grammaticalization score of each series, the six Lehmann parameters, position, status, corpus frequency, and frequency per million words.

freq_series.html

Zusammenfassende logarithmische Darstellung der absoluten Frequenzen der ZIPs i. w. S. mit „traditionellen“ und neu extrahierten Modifikatoren im Russischen, Ukrainischen, Polnischen, Tschechischen und Kroatischen nach den Webkorpora ruTenTen11, ukTenTen20, plTenTen12, csTenTen17 und hrWaC 2.2. Сводное логарифмическое представление абсолютных частот ZIPs в широком смысле с «традиционными» и новыми модификаторами в русском, украинском, польском, чешском и хорватском языках по веб-корпусам ruTenTen11, ukTenTen20, plTenTen12, csTenTen17 и hrWaC 2.2. Summary logarithmic representation of the absolute frequencies of ZIPs in the broader sense with “traditional” and newly extracted modifiers in Russian, Ukrainian, Polish, Czech, and Croatian, based on the ruTenTen11, ukTenTen20, plTenTen12, csTenTen17, and hrWaC 2.2 web corpora.

gramscore.html

Zusammenfassende graphische Darstellung der Grammatikalisierungsscores für die einzelnen Parameter, der Gesamtgrammatikalisierungsscores und der daraus abgeleiteten Grammatikalisierungsgrade. Сводное графическое представление оценок грамматикализации по отдельным параметрам, общих оценок грамматикализации и определённых на их основе степеней грамматикализации. Summary graphical representation of the grammaticalization scores for the individual parameters, the overall grammaticalization scores, and the grammaticalization degrees derived from them.

modifiers.type.csv

Zusammenfassung der Zahl der Modifikatoren nach etymologischem Typ, Position und Sprache. Сводная таблица с количеством модификаторов по этимологическому типу, позиции и языку. Summary of the number of modifiers by etymological type, position, and language.

lexical_etymological_similarity.csv

Rohdaten für die Berechnung der lexikalisch-etymologischen Ähnlichkeit zwischen den untersuchten Reihen. Исходные данные для расчета лексико-этимологического сходства между исследованными сериями. Raw data used to calculate lexical and etymological similarity between the analysed series.

Back to top Zum Anfang Наверх

Contact Kontakt Контакты

roman [at] fisun.org