UTF-16 codetabel
Voer korte tekst in om per teken de UTF-16-code-eenheden, BE/LE bytes en het type BMP of surrogaatpaar te bekijken, met behoud van een sneloverzicht van het bereik van surrogaten.
Hoe gebruikt u de UTF-16-codetabel
UTF-16 Code-eenheden en resultaten van de bytevolgorde worden alleen in de huidige browser berekend en de tekst wordt niet geüpload.
Korte tekst invoeren
Voer maximaal 64 Unicode scalaire waarden in; de tool verwerkt elk teken in de oorspronkelijke volgorde.
Code-eenheden bekijken
Bekijk teken voor teken één BMP-code-eenheid of een paar hoge en lage surrogaten, evenals de bijbehorende UTF-16BE en UTF-16LE bytes.
Bereik van surrogaten controleren
Zoeken naar één teken koppelt BMP of de surrogaatregels; je kunt ook TSV kopiëren of de invoer wissen.
Beperkingen en aandachtspunten
- De bytekolom toont alleen de bytes van de code-eenheden in de opgegeven bytevolgorde; er wordt niet automatisch BOM toegevoegd en de bytevolgorde van het bestand wordt niet afgeleid.
- Scalaire waarden uit aanvullende vlakken gebruiken twee 16 code-eenheden; het aantal code-eenheden kan niet rechtstreeks worden beschouwd als het aantal voor de gebruiker zichtbare tekens.
- Een losstaande hoge of lage surrogaatwaarde is geen geldige Unicode-scalaire waarde; de tool wordt veilig uitgeschakeld in plaats van vervangende bytes te genereren.
Veelgestelde vragen
Waarom heeft een Emoji twee UTF-16-code-eenheden?
Scalaire waarden van aanvullende vlakken vanaf U+10000 vereisen samen een hoge surrogaatwaarde en een lage surrogaatwaarde.
Waarom hebben UTF-16BE en UTF-16LE de omgekeerde bytevolgorde?
Beide geven dezelfde 16-bitcode-eenheden weer; alleen de opslagvolgorde van de hoge en lage bytes van elke code-eenheid verschilt.
Zal de pagina-uitvoer BOM bevatten?
Nee. Hier worden de coderingsbytes van één scalair weergegeven; of BOM nodig is, hangt af van het specifieke formaat en protocol.