Using voice-quality measurements with prosodic and spectral features for speaker diarization
Visualitza/Obre
Using Voice-quality Measurements with Prosodic and Spectral Features for Speaker Diarization.pdf (227,6Kb) (Accés restringit)
Sol·licita una còpia a l'autor
Què és aquest botó?
Aquest botó permet demanar una còpia d'un document restringit a l'autor. Es mostra quan:
- Disposem del correu electrònic de l'autor
- El document té una mida inferior a 20 Mb
- Es tracta d'un document d'accés restringit per decisió de l'autor o d'un document d'accés restringit per política de l'editorial
Estadístiques de LA Referencia / Recolecta
Inclou dades d'ús des de 2022
Cita com:
hdl:2117/85230
Tipus de documentComunicació de congrés
Data publicació2015
EditorInternational Speech Communication Association (ISCA)
Condicions d'accésAccés restringit per política de l'editorial
Tots els drets reservats. Aquesta obra està protegida pels drets de propietat intel·lectual i
industrial corresponents. Sense perjudici de les exempcions legals existents, queda prohibida la seva
reproducció, distribució, comunicació pública o transformació sense l'autorització del titular dels drets
Abstract
Jitter and shimmer voice-quality measurements have been successfully used to detect voice pathologies and classify different speaking styles. In this paper, we investigate the usefulness of jitter and shimmer voice measurements in the framework of the speaker diarization task. The combination of jitter and shimmer voice-quality features with the long-term prosodic and short-term spectral features is explored in a subset of the Augmented Multi-party Interaction (AMI) corpus, a multi-party and spontaneous speech set of recordings. The best results have been obtained by fusing the voice-quality features with the prosodic ones at the feature level, and then fusing them with the spectral features at the score level. Experimental results show more than 20% relative DER improvement compared to the spectral baseline system.
CitacióZewoudie, A., Jordi Luque, Hernando, J. Using voice-quality measurements with prosodic and spectral features for speaker diarization. A: Annual Conference of the International Speech Communication Association. "INTERSPEECH 2015: 16th Annual Conference of the International Speech Communication Association: Dresden, Germany: September 6-10, 2015". Dresden: International Speech Communication Association (ISCA), 2015, p. 3100-3104.
ISBN1990-9770
Versió de l'editorhttp://www.isca-speech.org/archive/interspeech_2015/i15_3100.html
Fitxers | Descripció | Mida | Format | Visualitza |
---|---|---|---|---|
Using Voice-qua ... or Speaker Diarization.pdf | 227,6Kb | Accés restringit |