Encoder & Konverter

Text-Encoder-Explorer – Unicode-, UTF-8- und UTF-16-Byte-Inspector

Erkunden Sie, wie Text in den Codepunkten UTF-8, UTF-16 und Unicode codiert ist. Zeigen Sie pro Zeichen Byte-Aufgliederungen, Hex-Dumps und Kodierungsstatistiken an. Kostenloses Online-tool, läuft vollständig in ihrem browser.

Kostenlos nutzbar Keine Anmeldung Läuft im Browser

Tool-Arbeitsbereich

12
Zeichen
19
UTF-8-Bytes
26
UTF-16-Bytes
CharCode PointUTF-8UTF-16DecimalName
HU+00484800 4872ASCII printable
eU+00656500 65101ASCII printable
lU+006C6C00 6C108ASCII printable
lU+006C6C00 6C108ASCII printable
oU+006F6F00 6F111ASCII printable
,U+002C2C00 2C44ASCII printable
U+00202000 2032Space
U+4E16E4 B8 964E 1619990U+4E16
U+754CE7 95 8C75 4C30028U+754C
!U+00212100 2133ASCII printable
U+00202000 2032Space
🌍U+1F30DF0 9F 8C 8DD8 3C DF 0D127757U+1F30D

Was ist Text Encoding?

Textcodierung ist der Prozess der Umwandlung von Zeichen in Folge von Bytes, die Computer speichern und übertragen können. Unicode weist jedem Zeichen in jedem Skript einen eindeutigen Codepunkt zu. UTF-8 und UTF-16 sind die beiden am häufigsten verwendeten Kodierungsformate: UTF-8 verwendet 1-4 Bytes pro Zeichen und ist die dominierende Kodierung im Web, während UTF-16 2 oder 4 Bytes verwendet und intern von JavaScript, Java und Windows verwendet wird. Mit diesem Tool können Sie genau untersuchen, wie jedes Zeichen in Ihrem Text in diesen Codierungen dargestellt wird, wobei Codepunkte, Bytesequenzen und eine Hex-Dump-Ansicht angezeigt werden.

So verwenden Sie den Text-Encoder-Explorer

  1. 1Geben Sie Text ein oder fügen Sie ihn in das Eingabefeld ein. Ein Standardbeispiel mit ASCII-, CJK- und Emoji-Zeichen wird bereitgestellt.
  2. 2Sehen Sie sich die Zeichentabelle an, um den Unicode-Codepunkt jedes Zeichens, UTF-8-Bytes, UTF-16-Bytes und den Dezimalwert zu sehen.
  3. 3Überprüfen Sie die Zusammenfassungsstatistiken für die Gesamtzahl der Zeichen, die Anzahl der UTF-8-Byte und die Anzahl der UTF-16-Byte.
  4. 4Wechseln Sie zur Registerkarte Hex Dump, um die rohen UTF-8-Bytes in einem traditionellen Hexdump-Format ähnlich wie xxd zu sehen.

Häufige Anwendungsfälle

Debugging-Codierungsprobleme

Überprüfen Sie Byte-Sequenzen, um Mojibake, falsche Zeichendarstellung oder Kodierungsfehler zwischen Systemen zu diagnostizieren.

Multibytezeichen verstehen

Sehen Sie genau, wie CJK-Zeichen, Emoji und akzentuierte Buchstaben in UTF-8 vs UTF-16 codiert sind.

Schätzung von Speicher und Bandbreite

Vergleichen Sie die Bytegrößen UTF-8 und UTF-16, um die effizienteste Kodierung für Ihre Daten auszuwählen.

Lernen Unicode und Kodierung Grundlagen

Eine praktische Referenz für Studenten und Entwickler, die lernen, wie Textcodierung auf Byte-Ebene funktioniert.

Häufig gestellte Fragen

Was ist der Unterschied zwischen UTF-8 und UTF-16?

UTF-8 codiert Zeichen mit 1 bis 4 Bytes, wobei ASCII-Zeichen nur 1 Byte einnehmen. UTF-16 verwendet 2 Bytes für die häufigsten Zeichen und 4 Bytes für ergänzende Zeichen (wie einige Emoji). UTF-8 ist effizienter für Latein-schweren Text, während UTF-16 kompakter für CJK-schweren Text sein kann.

Warum zeigen einige Zeichen mehrere Bytes?

Zeichen außerhalb des ASCII-Bereichs (Codepunkte über U+007F) erfordern mehrere Bytes in UTF-8. Zum Beispiel verwenden chinesische Zeichen typischerweise 3 Bytes in UTF-8, und Emoji mit Codepunkten über U+FFFF verwenden 4 Bytes in UTF-8 und UTF-16 (als Ersatzpaare).

Wird mein Text an einen Server gesendet?

Nein. Die gesamte Codierungsanalyse erfolgt vollständig in Ihrem Browser mit dem JavaScript TextEncoder API. Es werden keine Daten an einen Server übertragen.