Unicode
Unicode는 범용 문자 인코딩 표준입니다. 텍스트 파일, 웹 페이지 및 기타 유형의 문서에서 개별 문자가 표현되는 방식을 정의합니다.
기본적인 영어 문자만 표현하도록 설계된 ASCII와 달리 Unicode는 전 세계 모든 언어의 문자를 지원하도록 설계되었습니다. 표준 ASCII 문자 집합은 128개의 문자만 지원하는 반면, Unicode는 약 1,000,000개의 문자를 지원할 수 있습니다. ASCII는 각 문자를 표현하는 데 하나의 바이트만 사용하는 반면, Unicode는 각 문자에 최대 4바이트를 지원합니다.
Unicode 인코딩에는 여러 유형이 있지만, UTF-8과 UTF-16이 가장 일반적입니다. UTF-8은 웹에서 사용되는 표준 문자 인코딩이 되었으며, 많은 소프트웨어 프로그램에서 기본 인코딩으로도 사용됩니다. UTF-8은 문자당 최대 4바이트를 지원하지만, 자주 사용되는 문자를 표현하는 데 4바이트를 사용하는 것은 비효율적입니다. 따라서 UTF-8은 일반적인 영어 문자를 표현하는 데 1바이트만 사용합니다. 유럽 문자(라틴 문자), 히브리어 문자 및 아랍어 문자는 2바이트로 표현되며, 중국어, 일본어, 한국어 및 기타 아시아 문자를 표현하는 데는 3바이트가 사용됩니다. 추가 Unicode 문자는 4바이트로 표현할 수 있습니다.
지식 테스트하기