File:New_Unicode_logo.svg · Wikimedia Commons · See Wikimedia Commons
Unicode
Sign in to saveAlso known as The Unicode Standard, Uni-code, Unicode Standard
internationaler Standard zur Definition aller Schriftzeichen mit einem digitalen Code
Unicode is a standardized system that assigns unique numerical codes to characters used in all the world's writing systems, allowing computers to store and display text from any language or script. As of its latest version, it encompasses over 159,000 characters representing 172 different scripts, making it possible for digital devices to handle text reliably across languages and cultures.
AI-generated from the Wikipedia summary — may contain errors.
Key facts
- Character encoding.name
- Unicode
- Character encoding.image
- New Unicode logo.svg
- Character encoding.caption
- Logo of the Unicode Consortium
- Character encoding.standard
- Unicode Standard
- Character encoding.lang
- 168 scripts (list)
- Character encoding.encodings
- (uncommon) (obsolete)
- Character encoding.prev
- ISO/IEC 8859, among others
via Wikipedia infobox
Wikidata facts
- Publisher
- Unicode Consortium
- Official website
- unicode.org
Show 15 more facts
- Commons category
- Unicode
- topic's main category
- Category:Unicode
- Stack Exchange tag
- askubuntu.com/tags/unicode
- Commons gallery
- Unicode
- topic has template
- Template:Unicode
- Unicode range
- U+0000-10FFFF
- different from
- UTF-32
- ACM Classification Code (2012)
- 10011594
- software version identifier
- 17.0.0
- issue tracker URL
- unicode-org.atlassian.net
- partially coincident with
- Universal Character Set
- standards body
- Unicode Consortium
- publication date
- 1996-07-00
- official blog URL
- blog.unicode.org
- P13411
- Sagas of Icelanders
via Wikidata · CC0
Article · Deutsch
Der Unicode-Standard (Aussprachen: amerikanisches Englisch [ˈjuːnikoʊd], britisches Englisch [ˈjuːnikəʊd]; dt. [ˈjuːnikoːt]) legt fest, wie Schrift elektronisch gespeichert wird, z. B. auf einem Computer oder Telefon. Der durch den Standard festgelegte Zeichensatz enthält 145.000 Zeichen. Das Unicode-Konsortium hat dazu 159 moderne und alte Schriften berücksichtigt, wie auch Symbole, Emojis und nicht druckbare Steuerzeichen. Die ISO bezeichnet den Standard als ISO 10646 und den Zeichensatz als Universal Coded Character Set (UCS). Unicode muss auch tatsächlich in Nullen und Einsen übersetzt werden. Eine solche Umwandlung wird als Unicode Transformation Format (UTF) bezeichnet. Durchgesetzt hat sich dabei UTF-8. In einigen Fällen ist auch noch UTF-16 anzutreffen, speziell in Betriebssystemen und Programmiersprachen, da eine Umstellung nicht einfach ist.
Abstract from DBpedia / Wikipedia · CC BY-SA
Gallery (14)
Available in 122 languages
- Español
- Français
- Deutsch
- 中文
- 日本語
- Русский
- Português
- Italiano
- العربية
- हिन्दी
- Afrikaans
- Albanian
- Albanian
- Amharic
- Armenian
- Assamese
- Asturian
- Azerbaijani
Show 103 more
- Bahasa Indonesia
- Bangla
- Basque
- Bavarian
- be_x_old
- Belarusian
- Bhojpuri
- blk
- Bosnian
- Breton
- Bulgarian
- Burmese
- Catalan
- cdo
- Central Kurdish
- Cherokee
- Chuvash
- Croatian
- Czech
- Danish
- Esperanto
- Estonian
- Filipino
- Finnish
- Galician
- Georgian
- Greek
- Gujarati
- Hakka Chinese
- Hebrew
- Hungarian
- Icelandic
- Iloko
- Interlingua
- Irish
- Javanese
- Kannada
- Kashmiri
- Kazakh
- Kurdish
- Kyrgyz
- Latin
- Latvian
- Lingua Franca Nova
- Lithuanian
- Low German
- Macedonian
- Maithili
- Malay
- Malayalam
- Marathi
- Mari
- Mingrelian
- mnw
- Mongolian
- Nederlands
- Nepali
- Newari
- Norwegian
- Norwegian Nynorsk
- Occitan
- Papiamento
- Pashto
- Polski
- Punjabi
- Romanian
- Sanskrit
- Santali
- Scots
- Serbian
- Serbian (Latin)
- simple
- Sindhi
- Sinhala
- Slovak
- Slovenian
- Sundanese
- Svenska
- Swahili
- Tajik
- Tamil
- Telugu
- Tiếng Việt
- Toki Pona
- Türkçe
- Tuvinian
- Ukrainian
- Urdu
- Uyghur
- Uzbek
- Walloon
- Welsh
- Western Panjabi
- Wu Chinese
- Yakut
- Yiddish
- Yoruba
- zh_classical
- zh_min_nan
- zh_yue
- فارسی
- ไทย
- 한국어
via Wikidata sitelinks · CC0