Loquens (E-Journal)
Not a member yet
127 research outputs found
Sort by
Reconocimiento automático de locutor con hermanos españoles: hermanos gemelos (monozigóticos y dizigóticos) y no gemelos
The performance of the automatic speaker recognition (ASR) system BatvoxTM (Version 4.1) has been tested with a male population of 24 monozygotic (MZ) twins, 10 dizygotic (DZ) twins, 8 non-twin siblings and 12 unrelated speakers (aged 18–52 with Standard Peninsular Spanish as their mother tongue). Since the cepstral features in which this ASR system is based depend largely on anatomical–physiological foundations, we hypothesized that such features ought to be gene-dependent. Therefore, higher similarity values should be found in MZ twins (100% shared genes) than in DZ twins, in brothers (B) or in a reference population of unrelated speakers (US).
Results corroborated the expected decreasing scale MZ > DZ > B > US since the similarity coefficients yielded by the automatic system for these speakers decreased exactly in the same direction as the kinship degree of the four speaker groups diminishes. This suggests that the system features are to a great extent genetically conditioned and that they are hence useful and robust for comparing speech samples of known and unknown origin, as found in legal cases. Furthermore, the 9.9% EER (Equal Error Rate) obtained when testing MZ pairs lies around the same value (11% EER) found in Künzel (2010) with German twins.Hemos utilizado el sistema de reconocimiento automático BatvoxTM (versión 4.1) con una población de hablantes masculinos compuesta de 24 gemelos monocigóticos, 10 gemelos dicigóticos, 8 hermanos no gemelares y 12 hablantes no emparentados (edades comprendidas entre 18 y 52 años, con español centropeninsular como lengua materna). Puesto que los parámetros cepstrales en los que se basa BatvoxTM dependen en gran medida de las bases anatómicas y fisiológicas del tracto vocal del hablante, se propuso que estos debían estar influenciados genéticamente.
Esta hipótesis se pudo corroborar, puesto que los coeficientes de similitud arrojados por el sistema automático decrecen exactamente en la misma dirección en la que disminuye el grado de parentesco de las parejas de hablantes, es decir: gemelos monocigóticos, dicigóticos, hermanos no gemelares y hablantes no emparentados. Esto es, los gemelos monocigóticos obtuvieron valores más altos que los dicigóticos; estos, a su vez, mayores que los hermanos no gemelares, y, finalmente, estos últimos mayores que los hablantes no emparentados.
Estos resultados sugieren que los parámetros en los que está basado este sistema de reconocimiento están condicionados en gran medida por aspectos genéticos y, por tanto, resultan útiles y robustos para la comparación de muestras de voz dubitadas e indubitadas que encontramos en un caso típicamente forense. Por otro lado, el EER (Equal Error Rate) del 9 % que se obtuvo en las comparaciones exclusivamente de gemelos monocigóticos supone un valor muy similar al hallado en estudios anteriores con gemelos monocigóticos alemanes, como Künzel (2010): EER del 11 %
Diferentes distribuciones de la nasalización vocálica contrastiva en vasco
Contrastive vowel nasalization is usually a consequence of the reinterpretation of the phonetic nasalization of a vowel due to coarticulation with an adjacent nasal consonant as originating in the vowel itself. Basque developed contrastive vowel nasalization after the loss of the nasalized laryngeal /?./ (from older intervocalic *n). This loss did not occur under the same circumstances in all dialects, and thus yielded different distributions of contrastive nasalization. This paper discusses the development of two different patterns of contrastive vowel nasalization, namely those of Zuberoan and Roncalese dialects.
While modern Zuberoan shows contrastive vowel nasalization only in the last syllable, the now extinct Roncalese dialect had phonologically nasalized vowels in any syllable of the word. In addition, these two dialects possessed different nasalized vowel inventories. Other Basque dialects with attested contrastive vowel nasalization, such as Old Bizkaian, are discussed as well.
Although the presence of contrastive vowel nasalization in Basque is known in the literature (see Hualde, 1993, and Michelena, 1977/2011, for Zuberoan; and Michelena, 1954/2011, for Roncalese), this paper presents new analyses of vowel nasalization of two neighboring dialects of Basque, Zuberoan and Roncalese.La nasalización vocálica contrastiva es habitualmente consecuencia de la reinterpretación de la nasalización fonética de una vocal debida a la coarticulación con una consonante nasal adyacente como si esta se originase en la propia vocal. El euskera desarrolló nasalización vocálica contrastiva tras la pérdida de la laringal nasalizada /?./ (de antigua *n intervocálica). Esta pérdida no ocurrió en los mismos contextos en todos los dialectos y, por lo tanto, dio lugar a diferentes distribuciones de la nasalización contrastiva. Este artículo analiza el desarrollo de los patrones de nasalización vocálica contrastiva en los dialectos vascos suletino y roncalés.
Mientras que el suletino moderno muestra nasalización contrastiva solo en la última sílaba, el ahora extinto dialecto roncalés llegó a poseer vocales fonológicamente nasalizadas en cualquier sílaba de la palabra. Estos dos dialectos poseían, además, distintos inventarios de vocales nasalizadas. También se analizan otros dialectos vascos con nasalización vocálica atestiguada, como el vizcaíno antiguo.
A pesar de que la presencia de nasalización vocálica contrastiva en euskera es conocida en la bibliografía (v. Hualde, 1993, y Michelena, 1977/2011, para el suletino; y Michelena, 1954/2011, para el roncalés), este trabajo presenta nuevos análisis de la nasalización en suletino y roncalés, dos dialectos vascos vecinos
Caracterización acústica de las róticas fricativas prepausales en español peninsular
The aim of this study is to present an acoustic characterization of the prepausal rothic consonants produced with a single fricative component in Peninsular Spanish. To this end, four acoustic variables that account for their spectral structure (that is, center of gravity, standard deviation, skewness and kurtosis) and duration were analyzed. Results were statistically compared to the spectral characteristics of fricative consonants /s/ (with which they share place of articulation) in the same position. The results show significant statistical differences among the five variables, being the center of gravity of the fricatives 2600 Hz higher than the center of gravity of the rhotics. Alveolar fricatives also show higher values for the standard deviation and for the duration. On the contrary, regarding kurtosis and skewness, fricative sounds show lower values. Finally, a correct classification rate over 94% was achieved through linear discriminant analysis taking into account only the center of gravity and skewness as discriminant variables.El objetivo de este estudio es presentar una caracterización acústica de las consonantes róticas prepausales realizadas con un único componente fricativo en español peninsular. Para ello, se analizaron cuatro variables acústicas que dan cuenta de su estructura espectral (esto es, centro de gravedad, desviación estándar, asimetría y apuntamiento) y la duración. Los resultados del análisis se compararon estadísticamente con las características espectrales de las consonantes fricativas /s/ (con las que comparten punto de articulación) en la misma posición. Se han hallado diferencias estadísticamente significativas en las cinco variables, siendo el centro de gravedad en las fricativas superior en unos 2600 Hz al centro de gravedad de las róticas. Las fricativas alveolares también muestran un resultado superior en la desviación estándar y en la duración. Por el contrario, con respecto al apuntamiento y a la asimetría, los sonidos fricativos muestran valores inferiores. Finalmente, mediante el análisis lineal discriminante, se ha logrado un porcentaje de clasificaciones correctas superior al 94 % teniendo en cuenta únicamente como variables discriminantes el centro de gravedad y la asimetría
El papel de la percepción en el yeísmo: Estudio preliminar con jueces catalanohablantes
Yeísmo, as a change in progress in the Spanish phonological system, has been studied from various perspectives, especially from dialectology and articulatory phonetics. However, the role of the listener in its origins and spread has been scarcely analysed. In fact, it is necessary to focus on the side of the listener to detect if the articulatory similarity of sounds [ʎ] and [j] can be perceptively ambiguous and, thus, confounded. The present work wants to examine this topic in order to determine how the innovative neutralization could initiate. With this purpose we have carried out a perception study which consisted of three different tests: the first one worked as control test and the other two were used to find out if the change could be related to signal reception problems or to opacities in the input segmentation. In these experiments, we have used samples from a Spanish speaker who upholded /ʎ/ and /ʝ/ distinction (second test) and from a yeísta speaker (third test).
Despite our concern is to analyse the dephonologization of /?/ in Spanish, there is an important obstacle to achieve our goal: it is quite difficult to find Spanish speakers that do preserve the phonological distinction between /ʎ/ and /ʝ/ in the same way Spanish system once did. Therefore, we must rely on compared grammar: the judges of the perception tests were 20 Catalan speakers, a language that keeps this phonological contrast.
The results display that 30 % of the stimulus from Spanish speakers were misinterpreted. In addition, data suggest that the presence of an adjacent palatal vowel and the occurrence in an unstressed position may favour the confusion and, hence, the recategorization process.El fenómeno del yeísmo se ha abordado desde varias perspectivas pero se ha tratado muy poco el papel que desempeña el oyente en él. Como proceso de cambio en marcha, el receptor de la señal ha de tener necesariamente un papel esencial que permita esclarecer cómo se empezó a propagar la innovación yeísta. Con este propósito, se ha decidido llevar a cabo un estudio perceptivo que permita averiguar si [ʎ] y [j] pueden resultar ambiguos desde el punto de vista del receptor de la señal.
Sin embargo, la investigación de esta neutralización topa con una complicación inevitable: el avance de la innovación hace que sea difícil dar con hablantes que mantengan la distinción fonológica. Por este motivo, se ha acudido a la gramática comparada; es decir, se ha acudido a 20 jueces catalanohablantes que, en su L1, conservan la categoría /ʎ/ tal como en origen hizo el español. A estos jueces se les han administrado tres pruebas: una de ellas funcionaba como test de control y las otras dos, a partir de estímulos de locutores castellanohablantes distinguidores y yeístas, debían servir para averiguar si el cambio se puede achacar a problemas en la segmentación de la señal o a su recepción.
Los resultados indican que un 30 % de los estímulos en las pruebas realizadas con input del español constituyen casos de confusión, que viene favorecida, además, por la presencia del segmento objeto de atención en sílaba átona y en contacto con vocales palatales
¿Qué es la fonología computacional?
Computational phonology is not one thing. Rather, it is an umbrella term which may refer to work on formal language theory, computer-implemented models of cognitive processes, and corpus methods derived from the literature on natural language processing (NLP). This article gives an overview of these distinct areas, identifying commonalities and differences in the goals of each area, as well as highlighting recent results of interest. The overview is necessarily brief and subjective. Broadly speaking, it is argued that learning is a pervasive theme in these areas, but the core questions and concerns vary too much to define a coherent field. Computational phonologists are more united by a shared body of formal knowledge than they are by a shared sense of what the important questions are.La fonología computacional no representa un campo unitario, sino que es un término genérico que puede hacer referencia a obras sobre teorías de lenguajes formales; a modelos de procesos cognitivos implementados por ordenador; y a métodos de trabajo con corpus, derivados de la bibliografía sobre procesamiento del lenguaje natural (PLN). Este artículo ofrece una visión de conjunto de estas distintas áreas, identifica los puntos comunes y las diferencias en los objetivos de cada una, y pone de relieve algunos de los últimos resultados más relevantes. Esta visión de conjunto es necesariamente breve y subjetiva. En términos generales, se argumenta que el aprendizaje es un tema recurrente en estos ámbitos, pero las preguntas y los problemas centrales varían demasiado como para definir un área de estudio unitaria y coherente. Los fonólogos computacionales están unidos por un cúmulo común de conocimientos formales más que por un parecer compartido acerca de cuáles son las preguntas importantes
Hacia una teoría unificada de la producción y la percepción de la voz
At present, two important questions about voice remain unanswered: When voice quality changes, what physiological alteration caused this change, and if a change to the voice production system occurs, what change in perceived quality can be expected? We argue that these questions can only be answered by an integrated model of voice linking production and perception, and we describe steps towards the development of such a model. Preliminary evidence in support of this approach is also presented. We conclude that development of such a model should be a priority for scientists interested in voice, to explain what physical condition(s) might underlie a given voice quality, or what voice quality might result from a specific physical configuration.En la actualidad quedan por contestar dos cuestiones importantes relacionadas con la voz, a saber: (1) cuando la cualidad de la voz cambia, ¿qué alteración en el mecanismo vocal es la responsable?; y (2) si se produce un cambio en el sistema de producción de la voz, ¿qué cambio puede esperarse en la cualidad de voz percibida auditivamente? Sostenemos que la única respuesta posible a estas preguntas reside en un modelo de voz integrado que una producción y percepción, y describimos pasos hacia el desarrollo de tal modelo. Presentamos evidencias preliminares para respaldar esta propuesta. Concluimos que el desarrollo de semejante modelo debería ser una prioridad para los científicos interesados en la voz con el fin de explicar qué condición o condiciones físicas podrían subyacer a una cualidad de voz determinada, o qué cualidad de voz podría derivar de una configuración física específica
Sistemas de diálogo: una revisión
Spoken dialogue systems are computer programs developed to interact with users employing speech in order to provide them with specific automated services. The interaction is carried out by means of dialogue turns, which in many studies available in the literature, researchers aim to make as similar as possible to those between humans in terms of naturalness, intelligence and affective content.
In this paper we describe the fundaments of these systems including the main technologies employed for their development. We also present an evolution of this technology and discuss some current applications. Moreover, we discuss development paradigms, including scripting languages and the development of conversational interfaces for mobile apps.
The correct modelling of the user is a key aspect of this technology. This is why we also describe affective, personality and contextual models. Finally, we address some current research trends in terms of verbal communication, multimodal interaction and dialogue management.Los sistemas de diálogo son programas de ordenador desarrollados para interaccionar con los usuarios mediante habla, con la finalidad de proporcionarles servicios automatizados. La interacción se lleva a cabo mediante turnos de un tipo de diálogo que, en muchos estudios existentes en la literatura, los investigadores intentan que se parezca lo más posible al diálogo real que se lleva a cabo entre las personas en lo que se refiere a naturalidad, inteligencia y contenido afectivo.
En este artículo describimos los fundamentos de esta tecnología, incluyendo las tecnologías básicas que se utilizan para implementar este tipo de sistemas. También presentamos una evolución de la tecnología y comentamos algunas aplicaciones actuales. Asimismo, describimos paradigmas de interacción, incluyendo lenguajes de script y desarrollo de interfaces conversacionales para aplicaciones móviles.
Un aspecto clave de esta tecnología consiste en realizar un correcto modelado del usuario. Por este motivo, discutimos diversos modelos afectivos, de personalidad y contextuales. Finalmente, comentamos algunas líneas de investigación actuales relacionadas con la comunicación verbal, interacción multimodal y gestión del diálogo
El individuo y la activación del cambio fónico
This paper reviews current experimental approaches to sound change. An ongoing challenge in sound change research is to link the initiation of sound change within individual cognitive grammars to the diffusion of novel variants through the community. The articulatory and perceptual phonetic forces that bring about the pre-conditions for sound change and that explain its directionality are always present in the transmission of spoken language, yet sound systems are remarkably stable over time. This paper describes how recent approaches to the actuation problema converge on the idea that variability between individuals may be the key to understanding how some synchronic variation can become sound change. It then reviews the evidence for individual differences based on four areas of phonetic research (speech production, speech perception/cognitive processing, the perception-production link, and linguistic experience and imitation). This evidence suggests that differences between individuals may help to explain why sound change is so rarely actuated even though the phonetic pre-conditions are constantly being generated in spoken language interactions.El presente artículo analiza los actuales enfoques experimentales del cambio fonético. Un problema recurrente en la investigación del cambio fonético es vincular la iniciación del cambio fonético en la gramática cognitiva de un individuo con la difusión de nuevas variantes en la comunidad de habla. En la transmisión del lenguaje oral, las fuerzas articulatorias y perceptivas que hacen surgir las condiciones para el cambio fonético están siempre presentes. A pesar de esto, los sistemas fonológicos de las lenguas se caracterizan por ser considerablemente estables. En este artículo se presentan algunos de los distintos enfoques actuales sobre el problema de la iniciación del cambio fonético. Dichos enfoques coinciden en la idea de que la variabilidad interindividual puede ser la clave para comprender cómo de la variación sincrónica puede surgir cambio fonético. Se presenta una visión de conjunto de los diferentes factores que dan origen a la variación interindividual, basada en estudios fonéticos de cuatro áreas: 1) la producción del habla, 2) la percepción y el procesamiento cognitivo, 3) la relación entre la producción y la percepción y, 4) la experiencia lingüística y la imitación. Los resultados de estos estudios señalan que las diferencias individuales pueden ser el motor del cambio fonético. Al mismo tiempo ayudan a explicar por qué el cambio fonético es iniciado sólo raras veces –a pesar de que las interacciones entre hablantes generan constantemente las condiciones para el cambio fonético
Una máquina de escansión para poesía y prosa en neerlandés
This paper looks into the possibility that the rhythm present in poetry is the same that characterizes natural languages. This hypothesis, although attractive, faces serious problems such as the tremendous amount of data necessary to reach any valid conclusion and the fact that certain poetic traditions may deviate from the rhythm expected in a certain language. In order to tentatively test whether there is a relationship between the rhythmic properties of a certain language and its poetry we selected Dutch, a stress-timed language, and we took modern Dutch metric poetry as the object of study. Then, we created a tool that finds regular patterns of stressed and unstressed syllables in iambic pentameters and we compared our results to those of de Groot (1936). Finally, we discussed what factors could influence the noticeable findings for the beginning and the end of the studied verses and whether these findings could be the same for Dutch prose texts.En este artículo examinamos la posibilidad de que el ritmo presente en la poesía sea el mismo que caracteriza a las lenguas naturales. Esta hipótesis, aunque atractiva, se enfrenta a importantes problemas, tales como la necesidad de disponer de una ingente cantidad de datos para así obtener conclusiones válidas, o el hecho de que ciertas tradiciones poéticas pueden desviarse del ritmo esperado en una determinada lengua. Con el fin de examinar provisionalmente si existe una relación entre las propiedades rítmicas de una lengua concreta y su poesía, elegimos el neerlandés, una lengua acentualmente acompasada, y como objeto de estudio tomamos su poesía métrica moderna. Seguidamente creamos una herramienta que encuentra patrones regulares de sílabas tónicas y átonas en pentámetros yámbicos y comparamos nuestros resultados con los conseguidos por de Groot (1936). Por último, analizamos qué factores pueden influir sobre los hallazgos percibidos al comienzo y al final de los versos estudiados, y si estos resultados podrían ser los mismos para textos prosísticos del neerlandé