File:New_Unicode_logo.svg · Wikimedia Commons · See Wikimedia Commons
Unicode
Sign in to saveAlso known as The Unicode Standard, Uni-code, Unicode Standard
Padrão de caracteres
Unicode is a standardized system that assigns unique numerical codes to characters used in all the world's writing systems, allowing computers to store and display text from any language or script. As of its latest version, it encompasses over 159,000 characters representing 172 different scripts, making it possible for digital devices to handle text reliably across languages and cultures.
AI-generated from the Wikipedia summary — may contain errors.
Key facts
- Character encoding.name
- Unicode
- Character encoding.image
- New Unicode logo.svg
- Character encoding.caption
- Logo of the Unicode Consortium
- Character encoding.standard
- Unicode Standard
- Character encoding.lang
- 168 scripts (list)
- Character encoding.encodings
- (uncommon) (obsolete)
- Character encoding.prev
- ISO/IEC 8859, among others
via Wikipedia infobox
Article · Português
Unicode é um padrão que permite aos computadores representar e manipular, de forma consistente, texto de qualquer sistema de escrita existente. Publicado no livro The Unicode Standard, o padrão consiste de quase 138 mil caracteres, um conjunto de diagramas de códigos para referência visual, uma metodologia para codificação e um conjunto de codificações padrões de caracteres, uma enumeração de propriedades de caracteres como caixa alta e caixa baixa, um conjunto de arquivos de computador com dados de referência, além de regras para normalização, decomposição, ordenação alfabética e renderização. Atualmente, é promovido e desenvolvido pela Unicode Consortium, uma organização sem fins lucrativos que coordena o padrão, e que possui o objetivo de um dia substituir esquemas de codificação de caractere existentes pelo Unicode e pelos esquemas padronizados de transformação Unicode (chamado Unicode Transformation Format, ou UTF). Seu desenvolvimento é feito em conjunto com a Organização Internacional para Padronização (ISO) e compartilha o repertório de caracteres com o ISO/IEC 10646: o Conjunto Universal de Caracteres (UCS). Ambos funcionam equivalentemente como codificadores de caracteres, mas o padrão Unicode fornece muito mais informação para implementadores, cobrindo em detalhes tópicos como ordenação alfabética e visualização. Seu sucesso em unificar conjuntos de caracteres levou a um uso amplo e predominante na internacionalização e localização de programas de computador. O padrão foi implementado em várias tecnologias recentes, incluindo XML, Java e sistemas operacionais modernos.
Abstract from DBpedia / Wikipedia · CC BY-SA
Gallery (14)
Available in 122 languages
- Español
- Français
- Deutsch
- 中文
- 日本語
- Русский
- Português
- Italiano
- العربية
- हिन्दी
- Afrikaans
- Albanian
- Albanian
- Amharic
- Armenian
- Assamese
- Asturian
- Azerbaijani
Show 103 more
- Bahasa Indonesia
- Bangla
- Basque
- Bavarian
- be_x_old
- Belarusian
- Bhojpuri
- blk
- Bosnian
- Breton
- Bulgarian
- Burmese
- Catalan
- cdo
- Central Kurdish
- Cherokee
- Chuvash
- Croatian
- Czech
- Danish
- Esperanto
- Estonian
- Filipino
- Finnish
- Galician
- Georgian
- Greek
- Gujarati
- Hakka Chinese
- Hebrew
- Hungarian
- Icelandic
- Iloko
- Interlingua
- Irish
- Javanese
- Kannada
- Kashmiri
- Kazakh
- Kurdish
- Kyrgyz
- Latin
- Latvian
- Lingua Franca Nova
- Lithuanian
- Low German
- Macedonian
- Maithili
- Malay
- Malayalam
- Marathi
- Mari
- Mingrelian
- mnw
- Mongolian
- Nederlands
- Nepali
- Newari
- Norwegian
- Norwegian Nynorsk
- Occitan
- Papiamento
- Pashto
- Polski
- Punjabi
- Romanian
- Sanskrit
- Santali
- Scots
- Serbian
- Serbian (Latin)
- simple
- Sindhi
- Sinhala
- Slovak
- Slovenian
- Sundanese
- Svenska
- Swahili
- Tajik
- Tamil
- Telugu
- Tiếng Việt
- Toki Pona
- Türkçe
- Tuvinian
- Ukrainian
- Urdu
- Uyghur
- Uzbek
- Walloon
- Welsh
- Western Panjabi
- Wu Chinese
- Yakut
- Yiddish
- Yoruba
- zh_classical
- zh_min_nan
- zh_yue
- فارسی
- ไทย
- 한국어
via Wikidata sitelinks · CC0