Règles d’encodage Unicode

Saisissez un court texte pour afficher caractère par caractère les points de code Unicode, les valeurs décimales, le plan auquel ils appartiennent et les octets UTF-8, tout en conservant la consultation rapide des plages de points de code.

Traitement local dans le navigateur
Cette page a passé la vérification du répertoire public ; les fonctionnalités complètes sont disponibles après activation de JavaScript.
Mode d’emploi

Comment utiliser Unicode règles d’encodage

Les résultats de Unicode et UTF-8 sont calculés uniquement dans le navigateur actuel ; le texte n’est ni envoyé ni enregistré.

  1. Saisir un court texte

    Entrez au maximum 64 Unicode valeurs scalaires ; les espaces, les caractères répétés et l’ordre d’origine sont conservés.

  2. Afficher les informations du point de code

    Consultez caractère par caractère la notation U+, le point de code décimal, le plan Unicode et les octets hexadécimaux en majuscules UTF-8.

  3. Vérifier la plage

    La recherche d’un caractère unique est liée à la plage de points de code correspondante ; vous pouvez également copier TSV ou effacer les résultats.

Restrictions et remarques

  • L’outil segmente selon les valeurs scalaires Unicode, sans effectuer de NFC, de NFD ni d’autres normalisations ; les séquences combinées restent affichées sur plusieurs lignes.
  • Les unités de code de substitution U+D800–U+DFFF ne sont pas des valeurs scalaires Unicode ; les unités de substitution isolées ne sont pas encodées comme des caractères valides.
  • Un point de code et UTF-8 octets ne garantissent pas que la police possède un glyphe et ne remplacent pas les recherches dans d’anciens encodages tels que GBK, Big5.

Foire aux questions

Pourquoi un emoji qui ne s’affiche que sur une ligne comporte-t-il quatre octets UTF-8 ?

Cet emoji est un scalaire Unicode d’un plan supplémentaire, UTF-8 le représente sous forme de séquence de quatre octets.

Pourquoi des caractères qui semblent identiques peuvent-ils produire des résultats différents ?

Les caractères précomposés et les caractères de base suivis de marques combinatoires peuvent présenter des glyphes similaires, mais sont constitués de séquences scalaires Unicode différentes ; cet outil ne normalise pas automatiquement.

Dans quelle base sont les chiffres après U+ ?

La notation U+ utilise l’hexadécimal ; la page fournit également le point de code décimal pour faciliter la vérification croisée.

Commentaires sur la pageVous avez découvert un problème ou avez une suggestion d’amélioration ?
Les fonctions de retour nécessitent l’utilisation de la version en ligne

Veuillez activer JavaScript dans la version en ligne avant de soumettre ; les fonctionnalités locales de l’outil ou du cas ne sont pas affectées.

Aller vers la version en ligne pour envoyer des commentaires