Publikationsserver des Instituts für Deutsche Sprache
Not a member yet
11061 research outputs found
Sort by
Informationsmanagement im gesprochenen Deutsch. Eine diskurspragmatische Untersuchung syntaktischer Strukturen in Alltagsgesprächen
Die Studie untersucht die syntaktischen und lexikalischen Mittel, die verwendet werden, um die in der Spontansprache bevorzugte Verteilung von Information herzustellen. Quantitativ wird die von Du Bois als ‚Preferred Argument Structure‘ beschriebene Beschränkung von Teilsätzen auf einen neuen Referenten, der zudem in transitiven Sätzen in der Regel nicht als Subjekt erscheint, fürs Deutsche bestätigt und präzisiert. Qualitativ wird gezeigt, welche unterschiedlichen Funktionen bei der Ein- und Weiterführung von Referenten hochfrequente, semantisch unspezifische Verben (z.B. ‚haben‘ und ‚machen‘) übernehmen. Theoretisch wird vor dem Hintergrund gebrauchsbasierter Ansätze wie der Konstruktionsgrammatik die Möglichkeit der Integration diskurspragmatischer Tendenzen ins sprachliche Wissen diskutiert
Special Issue: Political and economic obstacles of minority language maintenance
This special issue of the Journal on Ethnopolitics and Minority Issues in Europe (JEMIE) brings together some of the participants of the symposium Political and Economic Resources and Obstacles of Minority Language Maintenance organized by the Language Survival Network ‘POGA’ at Tallinn University, Estonia, in December 2010. More than 20 scholars representing linguistics, anthropology, social sciences and law participated in the symposium, to present papers and discuss questions related to minority language loss, maintenance and revitalization. The six case studies contained in this special issue look at different minorities and regions in the European Union, Russia and the US. The linguistic communities discussed are the Russian-, Võru/Seto- and Latgalian-speaking minorities of Estonia and Latvia; the Welsh- and Breton-speaking communities of the Celtic language; the Russian Finno-Ugrian people with regional autonomies; and the native American groups of the Delaware/Cherokee and the Oneida. The reader will find articles relating to interdisciplinary research approaches in and on minority languages and minority language communities
Orthographie in Wissenschaft und Gesellschaft. Schriftsystem – Norm – Schreibgebrauch
Thema der 59. Jahrestagung des Leibniz-Instituts für Deutsche Sprache war vom 14. bis zum 16. März 2023 erstmals nach mehreren Jahrzehnten wieder die Orthografie des Deutschen, und zwar „in Wissenschaft und Gesellschaft“. Einen unmittelbaren Anlass dafür bildete der bevorstehende Abschluss der siebenjährigen Arbeitsphase des Rats für deutsche Rechtschreibung Ende 2023, dessen Tätigkeit das IDS seit seiner Gründung wissenschaftlich begleitet. Aber auch die Orthografieforschung selbst hat sich seit der Rechtschreibreform im Jahr 1996 in einer Weise entwickelt, dass die Wahl dieses schriftlinguistischen Querschnittsthemas angezeigt erschien
Vorwort
Thema der 59. Jahrestagung des Leibniz-Instituts für Deutsche Sprache war vom 14. bis zum 16. März 2023 erstmals nach mehreren Jahrzehnten wieder die Orthografie des Deutschen, und zwar „in Wissenschaft und Gesellschaft“. Einen unmittelbaren Anlass dafür bildete der bevorstehende Abschluss der siebenjährigen Arbeitsphase des Rats für deutsche Rechtschreibung Ende 2023, dessen Tätigkeit das IDS seit seiner Gründung wissenschaftlich begleitet. Aber auch die Orthografieforschung selbst hat sich seit der Rechtschreibreform im Jahr 1996 in einer Weise entwickelt, dass die Wahl dieses schriftlinguistischen Querschnittsthemas angezeigt erschien
CEFR vocabulary level as a predictor of user interest in English Wiktionary entries
This contribution explores the relationship between the English CEFR (Common European Framework of Reference for Languages) vocabulary levels and user interest in English Wiktionary entries. User interest was operationalized through the number of views of these entries in Wikimedia server logs covering a period of four years (2019–2022). Our findings reveal a significant relationship between CEFR levels and user interest: entries classified at lower CEFR levels tend to attract more views, which suggests a greater user interest in more basic vocabulary. A multiple regression model controlling for other known or potential factors affecting interest: corpus frequency, polysemy, word prevalence, and age of acquisition confirmed that lower CEFR levels attract significantly more views even after taking into account the other predictors. These findings highlight the importance of CEFR levels in predicting which words users are likely to look up, with implications for lexicography and the development of language learning materials
Literary conventions for the transcription of spoken Arabic
Computer-assisted transcription of speech is a basic methodical tool for linguistic studies. It is notoriously difficult to reconstruct spoken language by means of writing – even more so when it is embedded in interaction processes that are polylingual and polydialectal. The greater the difference between the writing systems and the less the orthographic standardisation of non-standard varieties, the more difficult the reconstruction. This is also true for the transcription of Arabic-German talk-in-interaction: Arabic script (right-to-left) and Latin script (left-to-right) have opposing writing directions and the established methods to transcribe Arabic data are mostly, first and foremost, concerned with the written language, thus making the data much more difficult to curate. So how can we transcribe and translate Spoken Arabic in a convenient conversation-analytic manner? Which solutions do romanisation systems offer? Under what circumstances can transcription methods and corpus technology meet the needs of interaction-oriented research? How far do current practices support the sustainability and reusability of transcribed data? This book presents self-developed solutions for a systematic approach to Spoken Arabic transcription within polylingual contexts. The data stems from audio and video recordings of interpreter-mediated counselling sessions conducted via the telephone
Paradigmatische Relationen syntagmatischer Muster: Muster- und Familienbildung von Prädikat-Argumentstrukturen mit skalarer Bedeutung und präpositional eingeleitetem Argument
Eine DaF/Z-Lerner*in fragt nach …? Wie man mit empirischen Ressourcen Fragen nach undokumentierten Phänomenen beantworten kann. Ein Rundgang durch verschiedene korpusbasierte Ressourcen
Dieser Werkstattbericht zeigt anhand verschiedener korpusbasierter Ressourcen, wie Fragen zu sprachlichen Phänomenen, die für Sprachlernende nicht oder nur unzureichend dokumentiert sind, empirisch beantwortet werden können. Besonderes Augenmerk wird dabei auf OWIDplusLIVE gelegt. Hierbei handelt es sich um ein Werkzeug zur tagesaktuellen Analyse von Token (einzelne Wortformen/Lemmata) und Bi-/Trigrammen (zwei bzw. drei direkt aufeinander folgende Token). Über eine Anbindung an KorAP können zudem Belege aus dem DeReKo (Deutsches Referenzkorpus) abgerufen und analysiert werden.This hands-on article uses various corpus-based resources to show how questions about linguistic phenomena that are undocumented or poorly documented for language learners can be answered empirically. Special attention is paid to OWIDplusLIVE. This is a tool for the daily analysis of tokens (single word forms/lemmas) and bi-/trigrams (two or three directly consecutive tokens). Via a connection to KorAP, samples from the DeReKo (German Reference Corpus) can also be retrieved and analyzed
Mitschreiben in Vorlesungen der Studieneingangsphase
Das Mitschreiben scheint ein vielversprechender Gegenstand zu sein, um die Kernanalysen des SpraStu-Projekts, die auf der Diagnostik verschiedener sprachlicher Kompetenzen fußen (vgl. Kapitel 1–4), um Analysen zu einer stärker im Studium situierten Sprachhandlung zu erweitern. Was und wie schreiben (L2-)Studierende verschiedener Studienfächer mit, was denken sie über das Mitschreiben, wie schwer fällt es ihnen (und warum), wie gehen sie mit ihren Notaten nach den Vorlesungen um? Wie beeinflussen sprachliche Charakteristika der Vorlesungen das Mitgeschriebene? Wie positionieren sich Lehrende zum Mitschreiben? Solche und viele weitere Fragen drängen sich auf. Neben einem breiten Spektrum spezifischer Methoden rund um die Mitschriftenerhebung, -aufbereitung und -auswertung machen wir uns für die im Folgenden dargelegten Untersuchungen auch weitere Informationen zunutze, die zu den Teilnehmenden im Gesamtprojekt erhoben wurden (bspw. die diagnostizierten Sprachkompetenzen und Daten zur sprachbezogenen Selbstregulation, vgl. Kapitel 2, 3 und 9)
Detecting impact relevant sections in scientific research
Impact assessment is an evolving area of research that aims at measuring and predicting the potential effects of projects or programs on a variety of stakeholders. While measuring the impact of scientific research is a vibrant subdomain of impact assessment, a recurring obstacle in this specific area is the lack of an efficient framework that facilitates labeling and analysis of lengthy reports. To address this issue, we propose, implement, and evaluate a framework for automatically assessing the impact of scientific research projects by identifying pertinent sections in research reports that indicate potential impact. We leverage a mixed-method approach that combines manual annotation with supervised machine learning to extract these passages from project reports. We experiment with different machine learning algorithms, including traditional statistical models as well as pre-trained transformer language models. Our results show that our proposed method achieves accuracy scores up to 0.81, and that our method is generalizable to scientific research from different domains and different languages