Publikationsserver des Instituts für Deutsche Sprache
Not a member yet
11061 research outputs found
Sort by
Less than a Lingua franca but more than just ‘any other language’: conceptualising German in the Baltic States as ‘additional language of society’
This paper discusses contemporary societal roles of German in the Baltic states (Latvia, Estonia, Lithuania). Speaker and learner statistics and a summary of sociolinguistic research (Linguistic Landscapes, language learning motivation, language policies, international roles of languages) suggest that German has by far fewer speakers and functions than the national languages, English, and Russian, and it is not a dominant language in the contemporary Baltics anymore. However, German is ahead of ‘any other language’ in terms of users and societal roles as a frequent language in education, of economic relations, as a historical lingua franca, and a language of traditional and new minorities. Highly diverse groups of users and language policy actors form a ‘coalition of interested parties’ which creates niches which guarantee German a frequent use. In the light of the abundance of its functions, the paper suggests the concept ‘additional language of society’ for a variety such as German in the Baltics – since there seems to be no adequate alternative labelling which would do justice to all societal roles. The paper argues that this concept may also be used for languages in similar societal situations and, not least, be useful in language marketing and the promotion of multilingualism
Introducing DeReKoGram: A novel frequency dataset with lemma and part-of-speech information for German
We introduce DeReKoGram, a novel frequency dataset containing lemma and part-of-speech (POS) information for 1-, 2-, and 3-grams from the German Reference Corpus. The dataset contains information based on a corpus of 43.2 billion tokens and is divided into 16 parts based on 16 corpus folds. We describe how the dataset was created and structured. By evaluating the distribution over the 16 folds, we show that it is possible to work with a subset of the folds in many use cases (e.g., to save computational resources). In a case study, we investigate the growth of vocabulary (as well as the number of hapax legomena) as an increasing number of folds are included in the analysis. We cross-combine this with the various cleaning stages of the dataset. We also give some guidance in the form of Python, R, and Stata markdown scripts on how to work with the resource
A user-oriented approach to evaluation and documentation of a morphological analyzer
This article describes a user-oriented approach to evaluate and extensively document a morphological analyzer with a view to normative descriptions of ISO and EAGLES. While current state-of-the-art work in this field often describes task-based evaluation, our users (supposedly rather NLP non-experts, anonymously using the tool as part of a webservice) expect an extensive documentation of the tool itself, the testsuite that was used to validate it and the results of the validation process. ISO and EAGLES offer a good starting point when attempting to find attributes that are to be evaluated. The documentation introduced in this article describes the analyzer in a way comparable to others by defining its features as attribute-value pairs (encoded in DocBook XML). Furthermore, the evaluation itself and its results are described
„Unsere Vorstellung, was gutes Deutsch ist, wurde im 19. Jahrhundert geprägt“. Ein SPIEGEL-Gespräch von Tobias Becker und Eva Thöne mit Henning Lobin
Redewiedergabe in Heftromanen und Hochliteratur
Die vorgestellte Studie untersucht die Anteile unterschiedlicher Redewiedergabeformen im Vergleich zwischen zwei Literaturtypen von gegensätzlichen Enden des Spektrums: Hochliteratur – definiert als Werke, die auf der Auswahlliste von Literaturpreisen standen – und Heftromanen, massenproduzierten Erzählwerken, die zumeist über den Zeitschriftenhandel vertrieben werden und früher abwertend als „Romane der Unterschicht” (Nusser 1981) bezeichnet wurden. Unsere These ist, dass sich diese Literaturtypen hinsichtlich ihrer Erzählweise unterscheiden, und sich dies in den verwendeten Wiedergabeformen niederschlägt. Der Fokus der Untersuchung liegt auf der Dichotomie zwischen direkter und nicht-direkter Wiedergabe, die schon in der klassischen Rhetorik aufgemacht wurde
Ausgangspunkte für die Betrachtung von Textqualität im digitalen Zeitalter
Dieser Beitrag gibt einen Überblick über die methodischen Ausgangspunkte des Projekts MIT. Qualität und stellt einige zentrale Erkenntnisse zur Modellbildung, der korpuslinguistischen Analyse und Akzeptabilitätserhebungen in der Sprachgemeinschaft vor. Wir zeigen dabei, wie bestehende Textqualitätsmodelle anhand einer Analyse einschlägiger Ratgeberliteratur erweitert werden können. Es wurden zwei empirische Fallstudien durchgeführt, die beide auf die Herstellung von textueller Kohärenz mittels des Kausalkonnektors weil fokussieren. Wir stellen zunächst eine korpuskontrastive Analyse vor. Weiterhin zeigen wir, wie man anhand verschiedener Aufgabenstellungen diverse Aspekte von Akzeptabilität in der Sprachgemeinschaft abprüfen kann
Latgalian. The Latgalian language in education in Latvia
This dossier consists of an introduction to the region under study, followed by six sections each dealing with a specific level of the education system. These brief descriptions contain factual information presented in a readily accessible way. Sections eight to ten cover research, prospects, and summary statistics. For detailed information and political discussions about language use at the various levels of education, the reader is referred to other sources with a list of publications
Einige neue Regularitäten im Gebrauch der Pronominalformen deren und derer
Mein Beitrag basiert auf zwei früheren Publikationen (Baerentzen 1995 und 2008), die hier in Auszügen wiedergegeben werden. Über die Verwendung der beiden Pronominalformen deren und derer herrscht im tatsächlichen Sprachgebrauch und in den grammatischen Darstellungen eine gewisse Unsicherheit. Anhand zahlreicher Korpusbelege wird im Folgenden zweierlei gezeigt: Im ersten Kapitel werden für die zum Teil komplementäre Distribution von deren und derer, vor allem in der Verwendung als Attribut eines Substantivs, gegenüber den traditionellen Beschreibungen präzisere Regeln sowie deren Begründung gegeben. Im zweiten Kapitel wird dann die ungewöhnliche, aber immer häufiger vorkommende Verwendung von derer als vorangestelltem Attribut eines Substantivs beschrieben und interpretiert
“Tyrannowerbus Rex”: Eine Betrachtung zur Verwendung von Über- und Beinamen von Wirtschaftsakteuren in Wirtschaftsartikeln
Ausgehend von der Feststellung, dass immer häufiger Wirtschaftsartikel die Person des Unternehmers/Managers porträtieren, befasst sich dieser Beitrag mit der Analyse solcher Artikel. Es wird untersucht, inwiefern derselbe Wirtschaftsakteur auf verschiedene Weise benannt wird. Oft werden dazu lexikalische Kreationen oder auch Anglizismen verwendet. Hierbei tritt zutage, dass diese Benennungen nicht zufällig erfolgen, sondern damit vom Autor stilistische, informative und gar argumentative Zwecke verfolgt werden