UTF-16 table de correspondance

Saisissez un court texte pour examiner caractère par caractère les unités de code UTF-16, les octets BE/LE et les types BMP ou de paires de substitution, tout en conservant la référence rapide des plages de substitution.

Traitement local dans le navigateur
Cette page a passé la vérification du répertoire public ; les fonctionnalités complètes sont disponibles après activation de JavaScript.
Mode d’emploi

Comment utiliser la table de codage UTF-16

UTF-16 Les unités de code et les résultats liés à l’ordre des octets sont calculés uniquement dans le navigateur actuel ; le texte n’est pas téléversé.

  1. Saisir un court texte

    Saisissez au maximum 64 valeurs scalaires Unicode ; l’outil traite les caractères dans l’ordre d’origine, un par un.

  2. Afficher l’unité de code

    Affichez caractère par caractère une unité de code BMP ou une paire d’unités de substitution haute et basse, ainsi que les octets UTF-16BE et UTF-16LE correspondants.

  3. Vérifier la plage des unités de substitution

    La recherche d’un seul caractère est liée à BMP ou aux règles des caractères de substitution ; vous pouvez copier TSV ou effacer l’entrée.

Restrictions et remarques

  • La colonne des octets affiche uniquement les octets des unités de code dans l’ordre des octets spécifié ; elle n’ajoute pas automatiquement BOM et ne déduit pas l’ordre des octets du fichier.
  • Les valeurs scalaires des plans supplémentaires utilisent deux unités de code de 16 bits ; le nombre d’unités de code ne peut pas être directement assimilé au nombre de caractères visibles par l’utilisateur.
  • Un substitut haut ou bas isolé n’est pas une valeur scalaire Unicode valide ; l’outil échoue et s’arrête au lieu de générer des octets de remplacement.

Foire aux questions

Pourquoi les emoji ont-ils deux unités de code UTF-16 ?

Les scalaires des plans supplémentaires au-delà de U+10000 nécessitent conjointement un substitut haut et un substitut bas pour être représentés.

Pourquoi UTF-16BE et UTF-16LE ont-ils des ordres d’octets inversés ?

Les deux représentent les mêmes unités de code de 16 bits ; seule l’ordre de stockage des octets de poids fort et de poids faible de chaque unité de code diffère.

La sortie de la page contiendra-t-elle BOM ?

Non. Les octets d’encodage d’un scalaire individuel sont affichés ici ; la nécessité de BOM dépend du format et du protocole concernés.

Commentaires sur la pageVous avez découvert un problème ou avez une suggestion d’amélioration ?
Les fonctions de retour nécessitent l’utilisation de la version en ligne

Veuillez activer JavaScript dans la version en ligne avant de soumettre ; les fonctionnalités locales de l’outil ou du cas ne sont pas affectées.

Aller vers la version en ligne pour envoyer des commentaires