语音识别
语音识别是电子设备理解口头语言的能力。麦克风记录人的声音,而硬件将信号从模拟声波转换为数字音频。然后,音频数据由软件处理,将声音解释为一个个单词。
语音识别的一种常见类型是“语音转文本”或“听写”软件,例如 Dragon Naturally Speaking。这类软件会在你说话时输出文本。虽然你可以购买语音识别程序,但现代版本的Macintosh和Windows操作系统都内置了听写功能。这项功能不仅可以让你记录文本,还可以执行基本的系统命令。
在 Windows 中,有些程序会自动支持语音识别,而有些则不会。你可以依次选择 ,然后点击“在所有位置启用听写”,为所有应用程序启用语音识别。在 OS X 中,你可以在“听写与语音”系统偏好设置面板中启用听写。只需点击“听写”旁边的“开启”按钮,即可启用语音转文本功能。要在支持该功能的程序中开始听写,请选择 。在 OS X 中,你还可以打开“辅助功能”系统偏好设置面板,然后选择“可说项目”,查看和编辑语音命令。
语音识别的另一种类型是交互式语音,这在移动设备上很常见,例如智能手机和平板电脑。iOS 和 Android 设备都允许你对手机说话并获得语音回复。iOS 版本称为“Siri”,充当个人助理。你可以让 Siri 在手机上保存提醒事项、告诉你天气预报、为你提供路线,或回答许多其他问题。这类语音识别被视为自然用户界面或(NUI),因为它会自然地响应你说出的输入。
虽然许多语音识别系统只支持英语,但有些语音识别软件支持多种语言。这需要为每种语言准备一个独特的词典,还需要额外的算法来理解和处理不同的口音。有些听写系统(例如 Dragon Naturally Speaking)可以经过训练来理解你的声音,并会随着时间推移进行适应,从而更准确地理解你。
测试你的知识