UTF-16 tabela de códigos
Insira um texto curto para visualizar, caractere por caractere, as unidades de código UTF-16, os bytes BE/LE e os tipos BMP ou de par substituto, mantendo uma consulta rápida das faixas de substitutos.
Como usar a tabela de codificação UTF-16
As unidades de código e os resultados de ordem de bytes de UTF-16 são calculados apenas no navegador atual; o texto não é enviado.
Inserir texto curto
Insira no máximo 64 valores escalares Unicode; a ferramenta os processa caractere por caractere na ordem original.
Ver unidade de código
Veja, caractere por caractere, uma unidade de código BMP ou um par de substitutos alto e baixo, além dos bytes UTF-16BE e UTF-16LE correspondentes.
Verificar o intervalo de substitutos
A consulta de um único caractere é vinculada a BMP ou às regras de agentes substitutos; é possível copiar TSV ou limpar a entrada.
Restrições e observações
- A coluna de bytes exibe apenas os bytes das unidades de código na ordem de bytes especificada; não adiciona automaticamente BOM nem infere a ordem de bytes do arquivo.
- Valores escalares de planos suplementares usam duas unidades de código de 16 bits; a quantidade de unidades de código não pode ser tomada diretamente como a quantidade de caracteres visíveis ao usuário.
- Um item substituto alto ou baixo isolado não é um valor escalar válido de Unicode; a ferramenta falha e é encerrada, em vez de gerar bytes substitutos.
Perguntas frequentes
Por que os Emojis têm duas unidades de código UTF-16?
Os escalares do plano suplementar acima de U+10000 precisam ser representados conjuntamente por um substituto alto e um substituto baixo.
Por que UTF-16BE e UTF-16LE têm a ordem dos bytes invertida?
Ambos representam as mesmas unidades de código de 16 bits; apenas a ordem de armazenamento dos bytes alto e baixo de cada unidade de código é diferente.
A saída da página incluirá BOM?
Não. Aqui são exibidos os bytes de codificação de um único escalar; a necessidade de BOM no arquivo depende do formato e do protocolo específicos.