Spracherkennung
Spracherkennung ist die Fähigkeit eines elektronischen Geräts, gesprochene Wörter zu verstehen. Ein Mikrofon zeichnet die Stimme einer Person auf, und die Hardware wandelt das Signal von analogen Schallwellen in digitale Audiodaten um. Die Audiodaten werden anschließend von Software verarbeitet, die den Klang als einzelne Wörter interpretiert.
Eine verbreitete Form der Spracherkennung ist Software zur „Sprach-zu-Text“-Umwandlung oder zum „Diktieren“, wie Dragon Naturally Speaking, die beim Sprechen Text ausgibt. Zwar können Sie Spracherkennungsprogramme kaufen, doch moderne Versionen der Betriebssysteme Macintosh und Windows verfügen über eine integrierte Diktierfunktion. Mit dieser Funktion können Sie Text aufnehmen und grundlegende Systembefehle ausführen.
Unter Windows unterstützen einige Programme die Spracherkennung automatisch, andere dagegen nicht. Sie können die Spracherkennung für alle Anwendungen aktivieren, indem Sie auswählen und auf „Diktieren überall aktivieren“ klicken. Unter OS X können Sie die Diktierfunktion in den Systemeinstellungen „Diktat & Sprache“ aktivieren. Aktivieren Sie einfach die Schaltfläche „Ein“ neben „Diktat“, um die Sprach-zu-Text-Funktion einzuschalten. Um in einem unterstützten Programm mit dem Diktieren zu beginnen, wählen Sie . Sie können gesprochene Befehle unter OS X auch anzeigen und bearbeiten, indem Sie die Systemeinstellungen „Bedienungshilfen“ öffnen und „Sprechbare Objekte“ auswählen.
Eine weitere Form der Spracherkennung ist die interaktive Spracheingabe, die auf mobilen Geräten wie Smartphones und Tablets häufig vorkommt. Sowohl Geräte mit iOS als auch mit Android ermöglichen es Ihnen, mit Ihrem Telefon zu sprechen und eine gesprochene Antwort zu erhalten. Die iOS-Version heißt „Siri“ und dient als persönlicher Assistent. Sie können Siri bitten, eine Erinnerung auf Ihrem Telefon zu speichern, Ihnen die Wettervorhersage mitzuteilen, Ihnen den Weg zu zeigen oder viele andere Fragen zu beantworten. Diese Form der Spracherkennung gilt als natürliche Benutzeroberfläche oder (NUI), da sie natürlich auf Ihre gesprochene Eingabe reagiert.
Während viele Spracherkennungssysteme nur Englisch unterstützen, unterstützt manche Spracherkennungssoftware mehrere Sprachen. Dafür ist ein eigenes Wörterbuch für jede Sprache sowie zusätzliche Algorithmen erforderlich, um verschiedene Akzente zu verstehen und zu verarbeiten. Einige Diktierprogramme wie Dragon Naturally Speaking können darauf trainiert werden, Ihre Stimme zu verstehen, und passen sich mit der Zeit an, um Sie immer genauer zu verstehen.
Testen Sie Ihr Wissen