File:New_Unicode_logo.svg · Wikimedia Commons · See Wikimedia Commons
AI overview
Unicode is a standardized system that assigns unique numerical codes to characters used in all the world's writing systems, allowing computers to store and display text from any language or script. As of its latest version, it encompasses over 159,000 characters representing 172 different scripts, making it possible for digital devices to handle text reliably across languages and cultures.
AI-generated from the Wikipedia summary — may contain errors.
Key facts
- Character encoding.name
- Unicode
- Character encoding.image
- New Unicode logo.svg
- Character encoding.caption
- Logo of the Unicode Consortium
- Character encoding.standard
- Unicode Standard
- Character encoding.lang
- 168 scripts (list)
- Character encoding.encodings
- (uncommon) (obsolete)
- Character encoding.prev
- ISO/IEC 8859, among others
via Wikipedia infobox
Wikidata facts
- Official website
- unicode.org
Show 10 more facts
- Commons category
- Unicode
- Stack Exchange tag
- askubuntu.com/tags/unicode
- Commons gallery
- Unicode
- Unicode range
- U+0000-10FFFF
- ACM Classification Code (2012)
- 10011594
- software version identifier
- 17.0.0
- issue tracker URL
- unicode-org.atlassian.net
- publication date
- 1996-07-00
- official blog URL
- blog.unicode.org
- P13411
- Sagas of Icelanders
via Wikidata · CC0
Gallery (14)
Available in 122 languages
- Español
- Français
- Deutsch
- 中文
- 日本語
- Русский
- Português
- Italiano
- العربية
- हिन्दी
- Afrikaans
- Albanian
- Albanian
- Amharic
- Armenian
- Assamese
- Asturian
- Azerbaijani
Show 103 more
- Bahasa Indonesia
- Bangla
- Basque
- Bavarian
- be_x_old
- Belarusian
- Bhojpuri
- blk
- Bosnian
- Breton
- Bulgarian
- Burmese
- Catalan
- cdo
- Central Kurdish
- Cherokee
- Chuvash
- Croatian
- Czech
- Danish
- Esperanto
- Estonian
- Filipino
- Finnish
- Galician
- Georgian
- Greek
- Gujarati
- Hakka Chinese
- Hebrew
- Hungarian
- Icelandic
- Iloko
- Interlingua
- Irish
- Javanese
- Kannada
- Kashmiri
- Kazakh
- Kurdish
- Kyrgyz
- Latin
- Latvian
- Lingua Franca Nova
- Lithuanian
- Low German
- Macedonian
- Maithili
- Malay
- Malayalam
- Marathi
- Mari
- Mingrelian
- mnw
- Mongolian
- Nederlands
- Nepali
- Newari
- Norwegian
- Norwegian Nynorsk
- Occitan
- Papiamento
- Pashto
- Polski
- Punjabi
- Romanian
- Sanskrit
- Santali
- Scots
- Serbian
- Serbian (Latin)
- simple
- Sindhi
- Sinhala
- Slovak
- Slovenian
- Sundanese
- Svenska
- Swahili
- Tajik
- Tamil
- Telugu
- Tiếng Việt
- Toki Pona
- Türkçe
- Tuvinian
- Ukrainian
- Urdu
- Uyghur
- Uzbek
- Walloon
- Welsh
- Western Panjabi
- Wu Chinese
- Yakut
- Yiddish
- Yoruba
- zh_classical
- zh_min_nan
- zh_yue
- فارسی
- ไทย
- 한국어
via Wikidata sitelinks · CC0
Connections
character encoding
Entity
ISO/IEC 8859-1
Entity
internationalized domain name
Entity
ISO/IEC 646
Entity
April Fools' Day Request for Comments
Entity
Universal Character Set characters
Entity
private use areas
Entity
Unicode equivalence
Entity
Cyrillic script
Entity
Apple Inc.
Concept
Latin script
Entity
macOS
Entity
runic script
Entity
Georgian scripts
Entity
World Wide Web Consortium
Entity
Coptic script
Entity
Thai script
Entity
Gurmukhi
Entity
Internet Engineering Task Force
Entity
Request for Comments
Entity