Reconocimiento de voz
El reconocimiento de voz es la capacidad de un dispositivo electrónico para comprender palabras habladas. Un micrófono graba la voz de una persona y el hardware convierte la señal de ondas de sonido analógicas en audio digital. Luego, los datos de audio son procesados por el software, que interpreta el sonido como palabras individuales.
Un tipo común de reconocimiento de voz es el software de «voz a texto» o de «dictado», como Dragon Naturally Speaking, que muestra el texto mientras usted habla. Aunque puede comprar programas de reconocimiento de voz, las versiones modernas de los sistemas operativos Macintosh y Windows incluyen una función de dictado integrada. Esta capacidad le permite grabar texto y ejecutar comandos básicos del sistema.
En Windows, algunos programas admiten el reconocimiento de voz automáticamente, mientras que otros no. Puede activar el reconocimiento de voz para todas las aplicaciones seleccionando y haciendo clic en «Enable dictation everywhere». En OS X, puede activar el dictado en el panel de preferencias del sistema «Dictation & Speech». Simplemente marque el botón «On» junto a Dictation para activar la capacidad de voz a texto. Para comenzar a dictar en un programa compatible, seleccione . También puede ver y editar los comandos hablados en OS X abriendo el panel de preferencias del sistema «Accessibility» y seleccionando «Speakable Items».
Otro tipo de reconocimiento de voz es la interacción por voz, común en dispositivos móviles, como los teléfonos inteligentes y las tabletas. Los dispositivos iOS y Android permiten hablarle al teléfono y recibir una respuesta verbal. La versión de iOS se llama «Siri» y funciona como asistente personal. Puede pedirle a Siri que guarde un recordatorio en su teléfono, le diga el pronóstico del tiempo, le dé indicaciones o responda muchas otras preguntas. Este tipo de reconocimiento de voz se considera una interfaz de usuario natural o (NUI), ya que responde de forma natural a sus entradas de voz.
Aunque muchos sistemas de reconocimiento de voz solo admiten el inglés, algunos programas de reconocimiento de voz admiten varios idiomas. Esto requiere un diccionario específico para cada idioma y algoritmos adicionales para comprender y procesar distintos acentos. Algunos sistemas de dictado, como Dragon Naturally Speaking, pueden entrenarse para reconocer su voz y se adaptan con el tiempo para entenderlo con mayor precisión.
Pon a prueba tu conocimiento