OCR
"Optical Character Recognition"의 약자입니다. OCR은 디지털 이미지 안의 텍스트를 인식하는 기술입니다. 일반적으로 스캔한 문서의 텍스트를 인식하는 데 사용되지만, 그 밖에도 다양한 용도로 활용됩니다.
OCR 소프트웨어는 문자, 숫자, 기호와 같은 문자를 찾아 인식하여 디지털 이미지를 처리합니다. 일부 OCR 소프트웨어는 텍스트를 단순히 내보내기만 하지만, 다른 프로그램은 이미지 안의 문자를 직접 편집 가능한 텍스트로 변환할 수 있습니다. 고급 OCR 소프트웨어는 페이지에 있는 텍스트의 크기와 서식뿐 아니라 텍스트의 배치도 내보낼 수 있습니다.
OCR 기술을 사용하면 문서의 하드카피를 전자 버전또는 (소프트카피)으로 변환할 수 있습니다. 예를 들어 여러 페이지로 된 문서를 TIFF 파일과 같은 디지털 이미지로 스캔한 다음 OCR 프로그램에 불러오면, 프로그램이 텍스트를 인식하고 문서를 편집 가능한 텍스트 파일로 변환합니다. 일부 OCR 프로그램에서는 문서를 스캔하고 한 번에 워드 프로세서 문서로 변환할 수 있습니다.
OCR 기술은 원래 인쇄된 텍스트를 인식하도록 설계되었지만, 손으로 쓴 텍스트를 인식하고 확인하는 데도 사용할 수 있습니다. 예를 들어 USPS와 같은 우편 서비스는 OCR 소프트웨어를 사용하여 주소를 기준으로 편지와 소포를 자동으로 처리합니다. 알고리즘은 스캔한 정보를 기존 주소 데이터베이스와 대조하여 우편 주소를 확인합니다. Google Translate 앱에는 기기의 카메라와 함께 작동하는 OCR 기술이 포함되어 있습니다. 이 기능을 사용하면 문서, 잡지, 표지판 및 기타 물체에서 텍스트를 촬영하고 이를 다른 언어로 실시간 번역할 수 있습니다.
지식 테스트하기