UTF
Significa «Unicode Transformation Format». UTF se refiere a varios tipos de codificaciones de caracteres Unicode, incluidas UTF-7, UTF-8, UTF-16 y UTF-32.
- UTF-7: utiliza 7 bits para cada carácter. Se diseñó para representar caracteres ASCII en mensajes de correo electrónico que requerían codificación Unicode.
- UTF-8: el tipo más popular de codificación Unicode. Utiliza un byte para las letras y los símbolos estándar del inglés, dos bytes para caracteres latinos y de Oriente Medio adicionales, y tres bytes para caracteres asiáticos. Los caracteres adicionales pueden representarse usando cuatro bytes. UTF-8 es compatible con versiones anteriores de ASCII, ya que los primeros 128 caracteres se asignan a los mismos valores.
- UTF-16: una extensión de la codificación Unicode «UCS-2», que utiliza dos bytes para representar 65.536 caracteres. Sin embargo, UTF-16 también admite cuatro bytes para caracteres adicionales, hasta un millón.
- UTF-32: una codificación multibyte que representa cada carácter con 4 bytes.
La mayor parte del texto de los documentos y las páginas web se codifica usando una de las codificaciones UTF anteriores. Muchos programas de procesamiento de textos no permiten ver la codificación de caracteres de los documentos abiertos, aunque algunos muestran la codificación en la parte inferior de la ventana del documento o en las propiedades del archivo. Si desea ver el tipo de codificación de caracteres que utiliza una página web, puede seleccionar para ver el HTML de la página. La codificación de caracteres, si está definida, se encontrará en la sección de encabezado, cerca de la parte superior del HTML. Una página que utiliza la codificación UTF-8 puede incluir uno de los siguientes fragmentos de texto, según la versión de HTML.
XHTML: <meta http-equiv="Content-Type" content="text/html; charset=utf-8" />
HTML 5: <meta charset="UTF-8">
Pon a prueba tu conocimiento