음성 인식
음성 인식은 전자 장치가 말로 한 단어를 이해하는 기능입니다. 마이크가 사람의 목소리를 녹음하면 하드웨어가 신호를 아날로그 음파에서 디지털 오디오로 변환합니다. 그런 다음 오디오 데이터는 소프트웨어에서 처리되며, 소프트웨어는 소리를 각각의 단어로 해석합니다.
일반적인 음성 인식 유형으로는 말하는 대로 텍스트를 출력하는 Dragon Naturally Speaking과 같은 "음성-텍스트 변환" 또는 "받아쓰기" 소프트웨어가 있습니다. 음성 인식 프로그램을 구매할 수도 있지만, 최신 버전의 Macintosh 및 Windows 운영 체제에는 기본 제공 받아쓰기 기능이 포함되어 있습니다. 이 기능을 사용하면 텍스트를 입력하고 기본적인 시스템 명령을 실행할 수 있습니다.
Windows에서는 일부 프로그램이 음성 인식을 자동으로 지원하지만 다른 프로그램은 지원하지 않습니다. 을 선택하고 "어디서나 받아쓰기 사용"을 클릭하면 모든 응용 프로그램에서 음성 인식을 사용할 수 있습니다. OS X에서는 "받아쓰기 및 음성" 시스템 환경설정 패널에서 받아쓰기를 활성화할 수 있습니다. 받아쓰기 옆의 "켜기" 버튼을 선택하기만 하면 음성-텍스트 변환 기능이 켜집니다. 지원되는 프로그램에서 받아쓰기를 시작하려면 을 선택합니다. OS X에서는 "손쉬운 사용" 시스템 환경설정 패널을 열고 "말할 수 있는 항목"을 선택하여 음성 명령을 확인하고 편집할 수도 있습니다.
또 다른 음성 인식 유형으로는 스마트폰 및 태블릿과 같은 모바일 장치에서 흔히 사용되는 대화형 음성이 있습니다. iOS와 Android 장치에서는 모두 휴대폰에 말을 걸고 음성으로 응답을 받을 수 있습니다. iOS 버전의 이름은 "Siri"이며 개인 비서 역할을 합니다. Siri에게 휴대폰에 미리 알림을 저장하거나, 일기 예보를 알려 주거나, 길 안내를 하거나, 그 밖의 여러 질문에 답하도록 요청할 수 있습니다. 이러한 유형의 음성 인식은 사용자의 음성 입력에 자연스럽게 응답하므로 자연스러운 사용자 인터페이스또는 (NUI)로 간주됩니다.
많은 음성 인식 시스템이 영어만 지원하는 반면, 일부 음성 인식 소프트웨어는 여러 언어를 지원합니다. 이를 위해서는 각 언어에 맞는 고유한 사전과 서로 다른 억양을 이해하고 처리하기 위한 추가 알고리즘이 필요합니다. Dragon Naturally Speaking과 같은 일부 받아쓰기 시스템은 사용자의 목소리를 이해하도록 학습시킬 수 있으며, 시간이 지나면서 사용자의 말을 더 정확하게 이해하도록 적응합니다.
지식 테스트하기