1,721,021 research outputs found
Per la storia della formazione delle parole in italiano: un nuovo corpus in rete (MIDIA) e nuove prospettive di studio
Maria Grossmann, Humanism in Wittemberg 1485-1517
Lefebvre Joël. Maria Grossmann, Humanism in Wittemberg 1485-1517. In: Bulletin de l'Association d'étude sur l'humanisme, la réforme et la renaissance, n°6, 1977. p. 40
Di tutti i colori. Studi linguistici per Maria Grossmann
Questo volume raccoglie 27 saggi originali di allievi, amici e colleghi di Maria Grossmann. Quasi 400 pagine di taglio e argomenti diversi di linguistica, che approfondiscono molti temi importanti, dalla morfologia alla sintassi e al lessico, dalla sociolinguistica alla semantica formale e alla linguistica storica; e che, cosa ormai purtroppo piuttosto rara, sono scritti in lingue diverse – italiano, inglese, spagnolo, francese, tedesco – da linguiste e linguisti di molti Paesi e continenti differenti
MARIA GROSSMANN, Opposizioni direzionali e prejissazione: analisi morfologica e semantica dei verbi egressivi prefissati con des- e e- sin catalano. Padua, Unipress, 1994
En un trabajo realizado con rigor y esmero, Maria Grossmann presenta, bajo el pretexto de estudiar los prefijos des- y e-., también el papel relativo de los prefijos que alternan con ellos: a-, en- y re-, así como de los sufijos formadores de verbos ingresivos/ causativos (-o, -ejar, -itzar, -ijicar), ya que con acierto reconoce las relaciones sistemáticas entre todos estos elemento
Criteri e strategie di classificazione morfo-sintattica dei testi del corpus MIDIA
MIDIA è un corpus di testi scritti in lingua italiana, completamente annotato con indicazione del lemma e della parte del discorso cui è ricondotta ciascuna occorrenza nei testi. Il corpus, che si estende dall’inizio del XIII alla prima metà del XX secolo, ripartito in cinque periodi temporali e sette tipologie testuali, comprende circa 7,5 milioni di occorrenze tratte da circa 800 testi. La selezione del corpus e gli strumenti di ricerca permettono una facile estrazione di dati, utili in particolare per lo studio della formazione delle parole in italiano dal punto di vista diacronico, ma fruibili anche per diverse altre tipologie di indagine linguistica. MIDIA è stato realizzato grazie al progetto PRIN 2009 La storia della formazione delle parole in italiano finanziato dal MIUR nel 2011. La consultazione a fini di ricerca è libera e gratuita. La realizzazione del portale MIDIA ha richiesto l’elaborazione di procedure di lemmatizzazione e di categorizzazione morfosintattica (PoS-tagging) che fossero applicabili e adeguate a testi scritti che differiscono notevolmente fra loro sia per l’appartenenza a diverse tipologie testuali sia perché risalgono a epoche diverse. Le dimensioni del corpus hanno reso inevitabile il ricorso all’analisi automatica, ma, come è noto, i programmi disponibili per l’italiano sono stati elaborati e addestrati principalmente allo scopo di annotare testi divulgativi di prosa contemporanea. La variazione sulle dimensioni dell’asse temporale e dell’asse tipologico del corpus MIDIA si riflette in differenze notevoli nella resa grafica delle forme e nell’ordine delle sequenze di parole rispetto a quanto atteso in testi di prosa giornalistica contemporanei, oltre che nella presenza di lessemi o di varianti non di uso corrente, caduti in desuetudine o appartenenti a terminologie specialistiche. Ciò ha determinato la necessità di intervenire sul programma di PoS-tagging utilizzato, per renderlo adatto all’analisi delle varietà diacroniche e tipologiche rappresentate nel corpus, e anche di approntare strategie di controllo e di revisione dei risultati dell’etichettatura automatica in modo da limitarne la percentuale di errore. In questo contributo intendiamo innanzitutto illustrare le scelte metodologiche e gli aspetti principali del lavoro di analisi e di lemmatizzazione dei testi che fanno parte del corpus MIDIA (§ 2) e dare conto di altri interventi precedenti e posteriori all’annotazione automatica volti a migliorare l’etichettatura del corpus (§ 3)
La nascita delle costruzioni non nominali di specie, genere, sorta e tipo: uno studio basato su corpora.
- …
