Unicode-Konverter
Unicode-Konverter
Konvertiere Zeichen zwischen Unicode, Hex, Dezimal, Binär und HTML-Entities. Mit interaktiver Tabelle, Suche und detaillierter Zeichenanalyse.
Hinweis: Dieses Tool dient zu Lern- und Referenzzwecken. Alle Berechnungen und Verarbeitungen erfolgen lokal in Ihrem Browser – es werden keine Daten an einen Server gesendet.
Inhaltsverzeichnis
Schnellübersicht
Auf dieser Seite findest du:
- Unicode-Konverter: Zeichen ↔ Hex, Dezimal, Binär, HTML-Entities
- Interaktive Tabelle: Alle Unicode-Zeichen mit Namen und Werten
- Unicode-Blöcke: Übersicht über die wichtigsten Bereiche
- Zeichenanalyse: Detaillierte Informationen zu jedem Zeichen
- Geschichte: Die Entwicklung von Unicode
- FAQ: Häufige Fragen zu Unicode
1. Unicode-Konverter
Gib einen Text ein oder einen Unicode-Wert – das Tool konvertiert in beide Richtungen.
Zeichen konvertieren
2. Die Welt von Unicode
Unicode ist der Standard für die digitale Textverarbeitung – hier die Grundlagen:
Geschichte von Unicode
Entwickelt, um die Probleme von ASCII zu lösen – nur 128 Zeichen reichten nicht für alle Schriftsysteme der Welt.
Heute: Über 149.000 Zeichen in Version 15.1
Aufbau von Unicode
Jedes Zeichen hat einen eindeutigen Codepoint (U+XXXX):
- U+0041: 'A'
- U+00E4: 'ä'
- U+1F60A: '😊'
UTF-8 Codierung
Die weltweit am häufigsten verwendete Unicode-Codierung:
- 1 Byte: ASCII-Zeichen (0-127)
- 2 Bytes: Lateinische Sonderzeichen
- 3 Bytes: Griechisch, Kyrillisch, Arabisch
- 4 Bytes: Emoji, CJK-Zeichen
Unicode-Ebenen (Planes)
Die 17 Ebenen von Unicode:
- Plane 0 (BMP): U+0000 bis U+FFFF – die wichtigsten Zeichen
- Plane 1 (SMP): U+10000 bis U+1FFFF – Historische Schriften, Emoji
- Plane 2 (SIP): U+20000 bis U+2FFFF – CJK-Erweiterungen
- Planes 3-16: Reserviert für zukünftige Nutzung
3. Die Geschichte von Unicode
Von ASCII zu Unicode – die Entwicklung der Zeichencodierung:
ASCII wird geboren
7-Bit-Code mit 128 Zeichen – nur für amerikanische Buchstaben. Grundlage für die digitale Textverarbeitung.
Das Kodierungs-Chaos
Verschiedene Codepages (Windows-1252, ISO-8859-1, KOI8-R) führen zu Problemen beim Datenaustausch. Kein System kann alle Sprachen darstellen.
Unicode 1.0
Joe Becker, Mark Davis und Lee Collins veröffentlichen Unicode 1.0 mit ~7.000 Zeichen – einheitlicher Standard für alle Schriftsysteme.
UTF-8 wird geboren
Ken Thompson und Rob Pike entwickeln UTF-8 – die variable Byte-Codierung, die ASCII rückwärtskompatibel macht.
UTF-8 wird zum Web-Standard
UTF-8 verdrängt andere Codierungen und wird zum Standard für HTML, XML und JSON.
Unicode 15.1
Über 149.000 Zeichen, alle Schriftsysteme der Welt, Emoji und historische Schriften – der universelle Standard.
6. FAQ – Häufige Fragen
Häufige Fragen zu Unicode
ASCII: 7-Bit-Code mit 128 Zeichen (0-127) – nur amerikanische Buchstaben, Zahlen und Steuerzeichen.
Unicode: Universeller Standard mit über 149.000 Zeichen – deckt alle Schriftsysteme der Welt ab.
Wichtig: Die ersten 128 Unicode-Zeichen sind identisch mit ASCII. So bleibt ASCII als Untermenge von Unicode erhalten.
UTF-8 ist die weltweit am häufigsten verwendete Unicode-Codierung.
Eigenschaften:
- Variable Länge: 1-4 Bytes pro Zeichen
- ASCII-kompatibel: Die ersten 128 Zeichen sind identisch mit ASCII
- Platzsparend: Für lateinische Texte nur 1 Byte pro Zeichen
- Standard: HTML, JSON, XML und die meisten modernen Systeme verwenden UTF-8
Ein Unicode-Codepoint ist die eindeutige Nummer eines Zeichens im Unicode-Standard.
Format: U+XXXX (Hexadezimal)
Beispiele:
- U+0041 = 'A'
- U+00E4 = 'ä'
- U+1F60A = '😊'
Insgesamt gibt es 1.114.112 mögliche Codepoints (17 Ebenen × 65.536).
UTF-16:
- Verwendet 2 oder 4 Bytes pro Zeichen
- Wird oft in Windows, Java und JavaScript verwendet
- Nicht ASCII-kompatibel
UTF-32:
- Verwendet immer 4 Bytes pro Zeichen
- Einfach zu verarbeiten, aber platzintensiv
- Wird selten im Web verwendet
Empfehlung: Für das Web und die meisten Anwendungen ist UTF-8 die beste Wahl.
Unicode 15.1 (September 2023) definiert 149.813 Zeichen.
Aufteilung:
- Basic Multilingual Plane (BMP): 65.536 Zeichen (U+0000 bis U+FFFF)
- Supplementary Planes: U+10000 bis U+10FFFF
- Schriften: Über 160 verschiedene Schriftsysteme
- Emoji: Über 3.600 Emoji-Zeichen
Neue Versionen werden regelmäßig veröffentlicht (ca. einmal pro Jahr).
Es gibt mehrere Möglichkeiten, Unicode in HTML zu verwenden:
- Direkt: Zeichen einfach in den HTML-Code schreiben (mit UTF-8-Deklaration)
- HTML-Entity (hex):
A= 'A' - HTML-Entity (dezimal):
A= 'A' - Named Entity:
©= '©'
Beispiel: 😊 zeigt ein 😊 an.
Zeichen (Character): Die abstrakte Einheit, die durch einen Unicode-Codepoint definiert wird.
Glyphe (Glyph): Die visuelle Darstellung eines Zeichens in einer bestimmten Schriftart.
Beispiel:
- Das Zeichen 'A' (U+0041) kann in verschiedenen Schriftarten (Times, Arial, Comic Sans) unterschiedlich aussehen.
- Die Glyphe ist die konkrete Darstellung – die Schriftart entscheidet, wie es aussieht.
Ein Quadrat (␣ oder ▯) wird angezeigt, wenn:
- Die Schriftart das Zeichen nicht unterstützt: Veraltete Schriftarten enthalten nicht alle Unicode-Zeichen
- Das System codiert falsch: Die Zeichencodierung stimmt nicht mit der tatsächlichen Codierung überein
- Das Zeichen ist ungültig: Es handelt sich um einen nicht definierten Codepoint
Lösung: Verwende eine moderne Schriftart mit guter Unicode-Unterstützung (z.B. Noto, Arial Unicode, Segoe UI).
Zusammenfassung
Die wichtigsten Punkte
- Unicode: Universeller Standard für alle Schriftsysteme der Welt
- Codepoint: Eindeutige Nummer jedes Zeichens (U+XXXX)
- UTF-8: Die wichtigste Codierung – ASCII-kompatibel und platzsparend
- UTF-16: Wird in Windows, Java und JavaScript verwendet
- Emoji: Seit Unicode 6.0 (2010) Teil des Standards
- HTML-Entities: Hex (`A`) oder dezimal (`A`)
- Unser Tool: Konvertiert Zeichen in alle wichtigen Formate
Weitere Entwickler-Tools
Die vollständige ASCII-Tabelle mit Suche, Filter und Dark Mode.
Zum ToolSichere Passwörter mit einstellbarer Länge und Zeichenarten generieren.
Zum ToolQR-Codes für URLs, Texte, WiFi, vCards und mehr erstellen.
Zum ToolLerne Binär, Hexadezimal und Oktal umzurechnen.
Zu Zahlensystemen