UTF-16 table de correspondance
Saisissez un court texte pour examiner caractère par caractère les unités de code UTF-16, les octets BE/LE et les types BMP ou de paires de substitution, tout en conservant la référence rapide des plages de substitution.
Comment utiliser la table de codage UTF-16
UTF-16 Les unités de code et les résultats liés à l’ordre des octets sont calculés uniquement dans le navigateur actuel ; le texte n’est pas téléversé.
Saisir un court texte
Saisissez au maximum 64 valeurs scalaires Unicode ; l’outil traite les caractères dans l’ordre d’origine, un par un.
Afficher l’unité de code
Affichez caractère par caractère une unité de code BMP ou une paire d’unités de substitution haute et basse, ainsi que les octets UTF-16BE et UTF-16LE correspondants.
Vérifier la plage des unités de substitution
La recherche d’un seul caractère est liée à BMP ou aux règles des caractères de substitution ; vous pouvez copier TSV ou effacer l’entrée.
Restrictions et remarques
- La colonne des octets affiche uniquement les octets des unités de code dans l’ordre des octets spécifié ; elle n’ajoute pas automatiquement BOM et ne déduit pas l’ordre des octets du fichier.
- Les valeurs scalaires des plans supplémentaires utilisent deux unités de code de 16 bits ; le nombre d’unités de code ne peut pas être directement assimilé au nombre de caractères visibles par l’utilisateur.
- Un substitut haut ou bas isolé n’est pas une valeur scalaire Unicode valide ; l’outil échoue et s’arrête au lieu de générer des octets de remplacement.
Foire aux questions
Pourquoi les emoji ont-ils deux unités de code UTF-16 ?
Les scalaires des plans supplémentaires au-delà de U+10000 nécessitent conjointement un substitut haut et un substitut bas pour être représentés.
Pourquoi UTF-16BE et UTF-16LE ont-ils des ordres d’octets inversés ?
Les deux représentent les mêmes unités de code de 16 bits ; seule l’ordre de stockage des octets de poids fort et de poids faible de chaque unité de code diffère.
La sortie de la page contiendra-t-elle BOM ?
Non. Les octets d’encodage d’un scalaire individuel sont affichés ici ; la nécessité de BOM dépend du format et du protocole concernés.