Unicode regras de codificação
Insira um texto curto para ver, caractere por caractere, os pontos de código Unicode, os valores decimais, o plano ao qual pertencem e os bytes UTF-8, mantendo também a consulta rápida dos intervalos de pontos de código.
Como usar as regras de codificação Unicode
Os resultados de Unicode e UTF-8 são calculados apenas no navegador atual; o texto não é enviado nem salvo.
Inserir texto curto
A entrada pode conter no máximo 64 valores escalares Unicode; espaços em branco, caracteres repetidos e a ordem original serão preservados.
Ver informações do ponto de código
Veja caractere por caractere a notação U+, o ponto de código decimal, o plano Unicode e os bytes UTF-8 em hexadecimal maiúsculo.
Verificar intervalo
A consulta de um único caractere vincula o intervalo de pontos de código correspondente; você também pode copiar TSV ou limpar os resultados.
Restrições e observações
- A ferramenta divide por valores escalares Unicode, sem realizar normalizações como NFC, NFD; sequências combinadas serão preservadas como várias linhas.
- Os substitutos U+D800–U+DFFF não são valores escalares Unicode; substitutos isolados não serão codificados como caracteres válidos.
- Os pontos de código e os bytes UTF-8 não garantem que a fonte tenha um glifo e também não substituem consultas de codificações antigas, como GBK e Big5.
Perguntas frequentes
Por que um Emoji aparece em apenas uma linha, mas tem quatro bytes de UTF-8?
Este Emoji é um valor escalar Unicode de um plano suplementar; UTF-8 o representa usando uma sequência de quatro bytes.
Por que caracteres que parecem iguais podem produzir resultados diferentes?
Um caractere pré-composto e um caractere básico com uma marca combinada podem apresentar glifos semelhantes, mas são compostos por sequências de valores escalares Unicode diferentes; esta ferramenta não faz normalização automática.
Em qual base numérica estão os dígitos após U+?
A notação U+ usa hexadecimal; a página também fornece os pontos de código decimais para facilitar a conferência cruzada.