Publikationsserver des Instituts für Deutsche Sprache
Not a member yet
11061 research outputs found
Sort by
Dialektkompetenz und Dialektgebrauch in Deutschland
Es gibt im deutschen Sprachraum eine lange zurückreichende Tradition der wissenschaftlichen Befassung mit der sprachlichen Variation im Raum. Die deutsche Sprachlandschaft ist insgesamt außerordentlich gut erforscht. Dabei sind die verschiedenen sprachlichen Ebenen, bei denen areale Variation eine Rolle spielt, von der Systemebene bis zu den sprachsoziologischen Verwendungsbedingungen, sehr gut beschrieben. Weniger gut ist die Datenlage in Bezug auf die Frage, von wie vielen Menschen der Dialekt gegenwärtig beherrscht und im Alltag genutzt wird. Eine mögliche Annäherung besteht in der Durchführung großer, im Idealfall repräsentativer, empirischer Erhebungen, bei denen Probanden zu ihren sprachlichen Kompetenzen und zu ihrem sprachlichen Verhalten befragt werden. Am Leibniz-Institut für Deutsche Sprache (IDS) werden seit einigen Jahren mit Regelmäßigkeit solche Repräsentativerhebungen zu Spracheinstellungen und sprachlichem Wissen sowie zu Sprachstatusfragen durchgeführt. Eine neue, bundesweite, repräsentative Umfrage hat das IDS im Winter 2017/18 in Kooperation mit dem Deutschen Institut für Wirtschaftsforschung (DIW) im Rahmen der Innovationsstichprobe des Sozio-ökonomischen Panels (SOEP-IS) des DIW durchgeführt, die Deutschland-Erhebung 2017. Sie besteht aus zwei Teilen, einem direkten Interview (n = 4.380) mit Fragen zu Sprach- und Dialektkompetenz sowie zu Sprach- und Dialektbewertungen und einem Onlinefragebogen (n = 1.439) mit rund vierzig weiteren sprachbezogenen Fragen. In der vorliegenden Darstellung werden die Antworten der Befragten auf die Fragen nach Dialektkompetenz und -gebrauch aufbereitet. Detaillierte Informationen zum Fragebogen und zur Stichprobe sind im Anhang zusammengestellt
EuReCo: Not Building and Yet Using Federated Comparable Corpora for Cross-Linguistic Research
This paper gives an overview of recent developments concerning the European Reference Corpus EuReCo, an open long-term initiative aimed at providing and using virtual and dynamically definable comparable corpora based on existing national, reference or other large corpora. Given the problems and shortcomings of other types of multilingual corpora – such as the shining-through effects in parallel corpora or the limitation to web material only in web-based comparable corpora – EuReCo constitutes a unique linguistic resource that offers new perspectives for fine-grained cross-linguistic research. The approach advocated here puts forward new solutions to notorious IPR and licensing issues, as well as to challenges of interoperability. It also addresses methodological questions concerning comparability and representativeness. While the focus of this paper is on EuReCo’s implementation-based approach to ensuring interoperability in a feasible and maintainable way, it also presents preliminary results of pilot comparative studies on light verb constructions in German, Romanian, Hungarian, Polish and Bulgarian, and reports on recent extensions and plans
Word frequency and cognitive effort in turns-at-talk: turn structure affects processing load in natural conversation
Frequency distributions are known to widely affect psycholinguistic processes. The effects of word frequency in turns-at-talk, the nucleus of social action in conversation, have, by contrast, been largely neglected. This study probes into this gap by applying corpus-linguistic methods on the conversational component of the British National Corpus (BNC) and the Freiburg Multimodal Interaction Corpus (FreMIC). The latter includes continuous pupil size measures of participants of the recorded conversations, allowing for a systematic investigation of patterns in the contained speech and language on the one hand and their relation to concurrent processing costs they may incur in speakers and recipients on the other hand. We test a first hypothesis in this vein, analyzing whether word frequency distributions within turns-at-talk are correlated with interlocutors’ processing effort during the production and reception of these turns. Turns are found to generally show a regular distribution pattern of word frequency, with highly frequent words in turn-initial positions, mid-range frequency words in turn-medial positions, and low-frequency words in turn-final positions. Speakers’ pupil size is found to tend to increase during the course of a turn at talk, reaching a climax toward the turn end. Notably, the observed decrease in word frequency within turns is inversely correlated with the observed increase in pupil size in speakers, but not in recipients, with steeper decreases in word frequency going along with steeper increases in pupil size in speakers. We discuss the implications of these findings for theories of speech processing, turn structure, and information packaging. Crucially, we propose that the intensification of processing effort in speakers during a turn at talk is owed to an informational climax, which entails a progression from high frequency, low-information words through intermediate levels to low-frequency, high- information words. At least in English conversation, interlocutors seem to make use of this pattern as one way to achieve efficiency in conversational interaction, creating a regularly recurring distribution of processing load across speaking turns, which aids smooth turn transitions, content prediction, and effective information transfer
Meta-semantic practices in social interaction. Definitions and specifications provided in response to Was heißt X (‘what does X mean’)
In social interaction, different kinds of word-meaning can become problematic for participants. This study analyzes two meta-semantic practices, definitions and specifications, which are used in response to clarification requests in German implemented by the format Was heißt X (‘What does X mean?’). In the data studied, definitions are used to convey generalizable lexical meanings of mostly technical terms. These terms are either unknown to requesters, or, in pedagogical contexts, requesters ask in order to check the addressee’s knowledge. Specifications, in contrast, clarify aspects of local speaker meanings of ordinary expressions (e.g., reference, participants in an event, standards applied to scalar expressions). Both definitions and specifications are recipient-designed with respect to the (presumed) knowledge of the addressee and tailored to the topical and practical relevancies of the current interaction. Both practices attest to the flexibility and situatedness of speakers’ semantic understandings and to the systematicity of using meta-semantic practices differentially for different kinds of semantic problems. Data are come from mundane and institutional interaction in German from the public corpus FOLK
Remixpraktiken in digitalen Kommunikaten
Im Beitrag wird aus einer medienlinguistischen Perspektive diskutiert, inwieweit sich digitale Kommunikation als Remix und Praktiken des Remixings fassen lässt. Hierzu wird ein Begriff des digitalen Kommunikats entworfen, der die semiotischen, medialen und pragmatischen Aspekte digitaler Kommunikation in den Blick nimmt. Digitale Kommunikate erweisen sich aus dieser Sichtweise als Einheiten multimodaler Zeichenkomplexe, die im Rahmen sozialer Praktiken, ihren Kommunikationssituationen und deren technisch-medialen Möglichkeitsbedingungen hervorgebracht werden. Wie die exemplarische Analyse von digitalen Kommunikaten in Twitterpostings, TikTok-Videos und der algorithmischen Generierung in Text-to-image-Verfahren mittels sogenannter künstlicher Intelligenz zeigt, spielen für Remixpraktiken in unterschiedlichen medialen Umgebungen vor allem die kreativen Bearbeitungen von Zeichenmodalitäten eine wichtige Rolle. Dem Remixing, das sich im Spannungsfeld von Kontinuität und Variation vollzieht, eröffnen differenzierte Zeichenmodalitäten Möglichkeiten zur stabilisierenden Orientierung und sprachlichen Kreativität. Die algorithmische (Bild-)Erzeugung durch Spracheingaben (prompts) stellt hierbei ein neuartiges Forschungsfeld für die Medienlinguistik dar.
1 Einleitung
2 Remix
3 Digitale Kommunikate
4 Analyse exemplarischer Remixings in der digitalen Kommunikation
5 Fazit
6 Literatu
Phraseographie im Lichte sprachwissenschaftlicher Quellenkunde. Oder: Aus welchen Quellen kann ein zweisprachiges phraseologisches Lernerwörterbuch gespeist werden?
In diesem Beitrag wird auf die Quellenlage eingegangen, mit der man konfrontiert wird, wenn man sich der Lernerphraseographie als Forschungsfeld zuwendet. Zunächst wird kurz erklärt, was unter einem phraseologischen Lernerwörterbuch zu verstehen ist, an welche Adressaten es sich richtet und welche Funktionen es zu erfüllen hat. Anschließend wird die Aufmerksamkeit auf die gegenwärtige Quellenlage gerichtet. Diese wird unter einem ausgewählten Aspekt – den Auswahlkriterien am Beispiel von Idiomen und Kollokationen – näher beleuchtet. In der abschließenden Fallstudie wird der Frage nachgegangen, mit welchen Methoden signifikante Kollokationen für die Belange eines zweisprachigen phraseologischen Lernerwörterbuchs ermittelt werden können
Substantivflexion, Attributsätze, Präfix- und Partikelverben
"Bausteine einer Korpusgrammatik des Deutschen" ist eine Schriftenreihe, die am Leibniz-Institut für Deutsche Sprache in Mannheim (IDS) entsteht. Sie setzt sich zum Ziel, mit korpuslinguistischen Methoden die Vielfalt und Variabilität der deutschen Grammatik in großer Detailschärfe zu erfassen und gleichzeitig für die Validierbarkeit der Ergebnisse zu sorgen. Der dritte Band enthält eine kurze Einleitung und drei als Kapitel einer neuen Grammatik gestaltete Texte: 1. Schwankungen zwischen schwacher und starker Substantivflexion, 2. Finite vs. infinite Attributsätze: zu-dass-Alternation bei Substantiven und 3. Präfix- und Partikelverben zwischen Morphologie und Syntax
Die Datenbank ZweiDat: Sprachliche Zweifelsfälle in historischer Perspektive
Dieser Beitrag stellt die Anfänge der Datenbank ZweiDat vor, die seit Sommersemester 2011 an der Universität Würzburg unter der Leitung von Professor Klein aufgebaut wird, und zeigt an drei Fallbeispielen, welche Fragestellungen man mit Hilfe dieser Datenbank beantworten kann. Alle hier gezeigten Abfragen beruhen auf dem Stand der Datenbank von Dezember 2011
Korpusdaten und Phraseodidaktik: Probleme und Perspektiven
Wortverbindungen sind der Schlüssel zu einer kulturell angemessenen Kommunikation. Mithilfe von Korpusdaten kann phraseologisches Wissen nahe am tatsächlichen Sprachgebrauch vermittelt werden. Der vorliegende Artikel stellt die Beiträge der Themenausgabe „Korpora, Phraseologie und DaF“ vor, die den Einsatz von Korpora, ihre hohe Wirksamkeit, aber auch die damit verbundenen Probleme für die Lehr- und Lernpraxis aus unterschiedlichen phraseodidaktischen Perspektiven beleuchten. Folgende Schwerpunkte der Beiträge werden in der Einleitung zusammengefasst: Frequenz als Mittel zur Erfassung besonders typischer und daher bevorzugt zu vermittelnder Phraseme; die Authentizität und Variabilität von Sprachdaten für das Verständnis relevanter Gebrauchsmerkmale; der Nutzen korpusbasierter Analysen für die Entwicklung interkultureller Kompetenz sowie die Möglichkeiten, korpusbasierte Beispiele und Übungen in den Unterricht zu integrieren.Multi-word units are the key to culturally appropriate communication. With the help of corpus data, phraseological knowledge can be conveyed close to current language use. This article presents the contributions to the thematic issue “Corpora, Phraseology and German as a Foreign Language”. From different phraseo-didactic perspectives, these articles shed light on the use of corpora, their great effectiveness, but also on the associated problems for teaching and learning practice. The following main points are summarised in the introduction: frequency as a way of identifying phrasemes that are particularly typical and therefore preferred for teaching, the authenticity and variability of language data for understanding relevant usage characteristics; the benefits of corpus-based analyses to develop intercultural competence, and the possibilities of integrating corpus-based examples and exercises into the classroom