Encodierungsliste

Kurzen Text eingeben, um die Codierungsergebnisse Zeichen für Zeichen mit Unicode, UTF-8, UTF-16 und ASCII, GB2312, GBK, GB18030 sowie Big5 zu vergleichen; die Übersicht über die Codierungszwecke bleibt erhalten.

Browserseitige lokale Verarbeitung
Diese Seite hat die öffentliche Verzeichnisprüfung bestanden; nach Aktivierung von JavaScript stehen die vollständigen Funktionen zur Verfügung.
Benutzerhandbuch

So verwenden Sie die Codeliste

Der eingegebene Text wird nur im aktuellen Browser anhand einer lokal festgelegten Zeichentabelle berechnet und weder hochgeladen noch gespeichert.

  1. Kurzen Text eingeben

    Geben Sie bis zu 64 Unicode-Skalarwerte ein oder fügen Sie sie ein; Leerzeichen, doppelte Zeichen und die ursprüngliche Reihenfolge bleiben erhalten.

  2. Zeichen für Zeichen vergleichen

    Zeigen Sie für jedes Zeichen Unicode, UTF-8, UTF-16 sowie die Bytes der verschiedenen älteren Kodierungen an; Hexadezimalwerte werden einheitlich in Großbuchstaben und durch Leerzeichen getrennt dargestellt.

  3. Kopieren oder leeren

    Das aktuelle Ergebnis kann als TSV kopiert und leichter in Tabellen eingefügt werden; die Schaltfläche zum Leeren entfernt gleichzeitig die Abfrageergebnisse.

Einschränkungen und Hinweise

  • Die GB2312-Spalte verwendet strikt die GB2312-1980-Zeichensatzzuordnung; die Spalten GBK, GB18030 und Big5 verwenden den Web-kompatiblen Algorithmus von WHATWG Encoding. Diese Maßstäbe sind nicht gleichbedeutend.
  • Big5 Die Abfrage enthält häufige HKSCS-Erweiterungen aus dem Index WHATWG; GB18030 verwendet feste Indizes und Bereichstabellen, ist jedoch kein Prüfer für die Konformität von Dateicodierungen.
  • Nicht abbildbare Zeichen werden ausdrücklich als „nicht unterstützt“ angezeigt und nicht durch Fragezeichen oder Ersatzzeichen als scheinbar erfolgreiches Ergebnis ausgegeben; aus den Abfrageergebnissen lässt sich außerdem die ursprüngliche Codierung unbekannter Dateien nicht ableiten.

Häufig gestellte Fragen

Warum unterscheiden sich die Bytes desselben Zeichens in verschiedenen Kodierungsspalten?

Jede Codierung verwendet einen eigenen Zeichensatz und eigene Zuordnungsregeln; weder gleiche noch unterschiedliche Bytes können belegen, dass diese Codierungen äquivalent sind.

Warum liefern Emojis nur in einigen Spalten Ergebnisse?

Unicode, UTF-8, UTF-16 und GB18030 können einen größeren Zeichenbereich abdecken. ASCII, das strikte GB2312, GBK für Web-Kompatibilität und Big5 decken jedoch nicht alle Emojis ab.

Werden die Abfragedaten an den Server gesendet?

Nein. Die Zuordnungsdaten und die Berechnungslogik werden lokal mit der Seite geladen; Eingaben und Ergebnisse bleiben im aktuellen Browser.

SeitenfeedbackProblem entdeckt oder Vorschlag zur Verbesserung?
Die Feedback-Funktion muss in der Online-Version verwendet werden

Bitte reichen Sie es in der Online-Version ein, nachdem Sie JavaScript aktiviert haben; die lokalen Funktionen des aktuellen Tools oder Beispiels sind davon nicht betroffen.

Zur Online-Version wechseln und Feedback geben