Publikationsserver des Instituts für Deutsche Sprache
Not a member yet
11061 research outputs found
Sort by
Amtliches Regelwerk der deutschen Rechtschreibung. Regeln und Wörterverzeichnis. Herausgegeben von der Geschäftsstelle des Rats für deutsche Rechtschreibung. Auf der Grundlage des Beschlusses des Rats für deutsche Rechtschreibung vom 15.12.2023 von den staatlichen Stellen in Bundesrepublik Deutschland, Republik Österreich, Schweizerische Eidgenossenschaft, Autonome Provinz Bozen-Südtirol, Deutschsprachige Gemeinschaft Belgiens, Fürstentum Liechtenstein im Jahr 2024 übereinstimmend beschlossen
Standards Information System for CLARIN centres and beyond
The present contribution describes features of the CLARIN Standards Information System that have been designed to assist data deposition centres in CLARIN. We also show what is needed and what has been done in order to go beyond the originally designated target, so as to provide service to sibling and descendant research infrastructures, of which DARIAH and Text+ are taken as examples. This paper is aimed primarily at representatives of research infrastructure nodes, responsible for preparing and sharing data deposition information about their centres or repositories. It assumes a degree of technical knowledge or experience in using the XML format and tools, the REST API, and version control systems
Of-genitive versus s-genitive. A corpus-based analysis of possessive constructions in 20th-century English
This paper examines genitive Variation in English, using two methodological approaches. In the manual approach, we extract genitive variants from the parsed subcorpora of the text category J (academic writing) in the B-Brown (1931), the Brown (1961) and the Frown (1991/2) corpora. Focussing on the syntactic parameter, we illustrate how the principle of end-weight gains ground from 1930 to 1990. The automatic approach implements the constraints of the manual approach, confirms the findings of the manual approach and is used to scale to British English. Methodologically, we show how to automatically sift out irrelevant corpus examples whose identification would normally need human intervention - in particular, apparent examples of the two main genitive English constructions which are not in genuine alternation
Der »Atlas zur Aussprache des deutschen Gebrauchsstandards« (AADG)
Das zentrale Thema des »Atlas zur Aussprache des deutschen Gebrauchsstandards« (AADG) ist die Dokumentation von Aussprachevarianten im Standarddeutschen für den gesamten Raum, in dem Deutsch Amts- und Unterrichtssprache ist (Deutschland, Österreich, Schweiz, Südtirol, Luxemburg, Ostbelgien, Liechtenstein). Grundlage des Atlas ist das Sprachkorpus ›Deutsch heute‹, das in den Jahren 2006–2009 von einem Forschungsprojekt des Leibniz-Instituts für Deutsche Sprache (IDS) erhoben wurde. Das Hauptkorpus besteht aus Sprachaufnahmen, die an 167 örtlichen Gymnasien mit je vier Schülerinnen und Schülern der Oberstufe gemacht wurden. In ca. 90-minütigen Aufnahmen wurde mittels verschiedener Lesetexte und einer mehrseitigen Wortliste die Vorleseaussprache erhoben
Automatic question answering for the linguistic domain – An evaluation of LLM knowledge base extension with RAG
We investigate the extent to which Retrieval Augmented Generation improves the quality of Large Language Models’ answers to technical questions in the field of linguistics—a domain known for its broad terminological inventory and theory-dependent use of technical terms. Furthermore, this application is not only about terminological information on language, but also about information on its well-formedness. We present the results of an empirical evaluation of automatically generated answers based on authentic data from a language consulting service, with special emphasis on different question types
Language change for the worse
Many theories hold that language change, at least on a local level, is driven by a need for improvement. The present volume explores to what extent this assumption holds true, and whether there is a particular type of language change that we dub language change for the worse, i.e., change with a worsening effect that cannot be explained away as a side-effect of improvement in some other area of the linguistic system. The chapters of the volume, written by leading junior and senior scholars, combine expertise in diachronic and historical linguistics, typology, and formal modelling. They focus on different aspects of grammar (phonology, morphosyntax, semantics) in a variety of language families (Germanic, Romance, Austronesian, Bantu, Jê-Kaingang, Wu Chinese, Greek, Albanian, Altaic, Indo-Aryan, and languages of the Caucasus). The volume contributes to ongoing theoretical debates and discussions between linguists with different theoretical orientations
Datensatz Schwache Maskulina
Der Datensatz enthält eine Sammlung von 1.156 Substantiven (mit wenigen Ausnahmen Maskulina), die sich im Korpusgrammatik-Untersuchungskorpus (Bubenhofer et al. 2014), basierend auf dem Deutschen Referenzkorpus DeReKo (Kupietz et al. 2010, 2018), Release 2017-II, unmittelbar nach einem Beleg für die Akkusativ- oder Dativform des unbestimmten Artikels ( einen / einem ) mindestens einmal mit der “schwachen” Endung -(e)n belegen lassen (z.B. einen Aktivisten , einem Autoren ). Einzelheiten zur Datenerhebung in Weber & Hansen (2023)
Die kommunikative Identität des Tricksters. Eine gesprächslinguistische und kultursemiotische Untersuchung zur Identitätskonstruktion in einer marginalisierten Gruppe
Der Trickster ist ein mythisch-literarischer Archetyp, dessen listenreicher, verwandlungsfähiger Charakter seit Ende des 19. Jahrhunderts Mythenforscher, Literaturwissenschaftler, Soziologen und Psychologen fasziniert. Erstmals wird in dieser Arbeit mit den Methoden der linguistischen Gesprächsanalyse und dem semiotischen Vergleich gezeigt, wie sich der Trickster als kommunikative Identität in Alltagsgesprächen manifestiert.
In den Gesprächen männlicher Erwerbsloser auf einem Hamburger Platz entsteht die Identität des Tricksters als Ausdruck und Bearbeitung sozialer Marginalisierungsprozesse: durch sprachliche Mittel, wie z. B. im Fiktionalisieren als Gestaltwandler und Doppelgänger, im Rätselspiel als ‚Meister des sprachlichen Kodes‘, im Klatschgespräch als ein die gesellschaftlichen Absurditäten karikierender Schelm. Damit knüpft die Arbeit an die linguistische Identitätsforschung an und eröffnet mit der Methode des kultursemiotischen Vergleichs zudem neue Perspektiven auf diese
Das Orthografische Kernkorpus (OKK) in DeReKo. Zusammensetzung, Analyse- und Zugriffsmöglichkeiten über KorAP
Für die spezifischen Bedürfnisse der Schreibbeobachtung wurde das Orthografische Kernkorpus (OKK) als virtuelles Korpus in DeReKo entwickelt. Mit derzeit rund 14 Mrd. Token deckt es den Schriftsprachgebrauch in den deutschsprachigen Ländern im Zeitraum von 1995 bis in die Gegenwart ab. Der Zugriff über die Korpusanalyseplattform KorAP erlaubt nicht nur die Nutzung verschiedener Annotationen, sondern über die API-Schnittstellen auch die Einbindung in diverse Auswertungsumgebungen wie RStudio über den RKorAPClient und macht es so für zahlreiche Analyse- und Visualisierungsmöglichkeiten zugänglich