Reverberation Modelling for Robust Speech Recognition in Reverberant Environments

Third party funded individual grant

Start date : 01.08.2008

End date : 30.08.2011

Overview

Project details

Scientific Abstract

Heutige Spracherkennungssysteme erzielen bemerkenswerte Erkennungsraten, wenn Nahbesprechungsmikrofone für die Aufnahme der Sprache verwendet werden. Aufgrund des größeren Abstandes zwischen Sprecher und Mikrofon erschweren im Freisprechbetrieb additive Störungen und der Nachhall des Nutzsignals die Erkennung erheblich. Während in den letzten Jahrzehnten beachtliche Fortschritte hinsichtlich der Robustheit der Erkenner bezüglich additiven Störungen erzielt wurden, bereitet der Nachhall nach wie vor Probleme bei der Erkennung. In diesem Forschungsvorhaben soll ein neuer Ansatz zur robusten Spracherkennung basierend auf der expliziten Modellierung des Nachhalls im Merkmalbereich weiterentwickelt werden. Insbesondere soll der Ansatz für leistungsfähige Sprachmerkmale und leistungsfähige akustische Modelle erweitert und mit in halligen Umgebungen aufgenommenen Sprachdaten anhand komplexer Aufgabenstellungen evaluiert werden.

Involved:

Walter Kellermann Project Leader

Contributing FAU Organisations:

Professur für Signalverarbeitung

Funding Source

DFG-Einzelförderung / Sachbeihilfe (EIN-SBH)