UTF
"Unicode Transformation Format"의 약어입니다. UTF는 UTF-7, UTF-8, UTF-16, UTF-32를 포함한 여러 유형의 Unicode 문자 인코딩을 가리킵니다.
- UTF-7 - 각 문자에 7개의 비트를 사용합니다. Unicode 인코딩이 필요한 이메일 메시지에서 ASCII 문자를 나타내도록 설계되었습니다.
- UTF-8 - 가장 널리 사용되는 Unicode 인코딩 유형입니다. 표준 영어 문자와 기호에는 1바이트, 추가 라틴 문자와 중동 문자에는 2바이트, 아시아 문자에는 3바이트를 사용합니다. 추가 문자는 4바이트를 사용해 나타낼 수 있습니다. 처음 128개 문자가 동일한 값에 매핑되므로 UTF-8은 ASCII와 하위 호환됩니다.
- UTF-16 - 2바이트로 65,536개의 문자를 나타내는 "UCS-2" Unicode 인코딩의 확장입니다. 하지만 UTF-16은 최대 100만 개의 추가 문자를 위해 4바이트도 지원합니다.
- UTF-32 - 각 문자를 4바이트로 나타내는 다중 바이트 인코딩입니다.
문서와 웹 페이지의 대부분의 텍스트는 위 UTF 인코딩 중 하나를 사용해 인코딩됩니다. 많은 워드 프로세싱 프로그램에서는 열려 있는 문서의 문자 인코딩을 볼 수 없지만, 일부 프로그램은 문서 창의 아래쪽이나 파일 속성에 인코딩을 표시합니다. 웹 페이지에서 사용된 문자 인코딩 유형을 확인하려면 를 선택해 페이지의 HTML을 볼 수 있습니다. 문자 인코딩이 정의되어 있다면 HTML의 위쪽에 가까운 헤더 섹션에 표시됩니다. UTF-8 인코딩을 사용하는 페이지에는 HTML 버전에 따라 다음 텍스트 조각 중 하나가 포함될 수 있습니다.
XHTML: <meta http-equiv="Content-Type" content="text/html; charset=utf-8" />
HTML 5: <meta charset="UTF-8">
지식 테스트하기