Skip to content
UTF-16
EntityQ740701· pop 29· linked from 611 articles

Also known as 16-bit Unicode Transformation Format, Unicode Transformation Format – 16-bit, Unicode Transformation Format - 16-bit, UTF16, UTF_16

UTF-16 (16-bit Unicode Transformation Format) is a character encoding that supports all 1,112,064 valid code points of Unicode. The encoding is variable-length as code points are encoded with one or two code units. UTF-16 arose from an earlier obsolete fixed-width 16-bit encoding now known as UCS-2 (for 2-byte Universal Character Set), once it became clear that more than 216 (65,536) code points were needed, including most emoji and important CJK characters such as for personal and place names.

Key facts

Character encoding.name
UTF-16
Character encoding.mime
• text/plain;charset=UTF-16• text/plain; charset=utf-16le• text/plain; charset=utf-16be
Character encoding.image
UTF-16 encoding.svg
Character encoding.caption
Example of Unicode character encoding through UTF-16
Character encoding.standard
Unicode Standard
Character encoding.classification
Unicode Transformation Format, variable-width encoding
Character encoding.lang
International
Character encoding.encodes
ISO/IEC 10646 (Unicode)
Character encoding.extends
UCS-2

via Wikipedia infobox

Described at

IBM Documentation

IBM Documentation.

ibm.com

Link to a page describing this subject · 9,349 chars · not written by Vinony

Wikidata facts

Follows
UCS-2
Show 5 more facts
different from
Unicode
data size
16
Commons category
UTF-16
Sources (1)

via Wikidata · CC0

Article · Español

UTF-16, que significa en ISO/IEC 10646:2003 “UCS Transformation Format for 16 Planes of Group 00”, es una forma de codificación de caracteres UCS y Unicode utilizando símbolos de longitud variable. Está oficialmente definida en el Anexo C de la norma ISO/IEC 10646:2003. También está descrita en el Estándar Unicode (versión 3.0 o superior), al igual que en la RFC 2781 de la IETF. Sus características principales son: * Es capaz de representar cualquier carácter Unicode. * Utiliza símbolos de longitud variable: 1 o 2 palabras de 16 bits por carácter Unicode (2 o 4 bytes). La unidad de información es la palabra de 16 bits. * Está optimizado para representar caracteres del plano básico multilingüe (BMP) y caracteres del rango U+0000 a U+FFFF. El BMP contiene la gran mayoría de caracteres y sistemas de escritura en uso en la actualidad. Cuando se limita al plano básico multilingüe, UTF-16 puede ser considerado una forma de codificación con símbolos de tamaño fijo (16 bits). * No superposición: Los símbolos de 1 palabra (16 bits) utilizan un subconjunto de valores que no puede utilizarse en símbolos de 2 palabras (32 bits).

Abstract from DBpedia / Wikipedia · CC BY-SA

Gallery (2)