Unicode-Konverter

ENTWICKLER-TOOL

Unicode-Konverter

Konvertiere Zeichen zwischen Unicode, Hex, Dezimal, Binär und HTML-Entities. Mit interaktiver Tabelle, Suche und detaillierter Zeichenanalyse.

5 Formate Unicode-Tabelle Suche Dark Mode Geschichte

Hinweis: Dieses Tool dient zu Lern- und Referenzzwecken. Alle Berechnungen und Verarbeitungen erfolgen lokal in Ihrem Browser – es werden keine Daten an einen Server gesendet.

Inhaltsverzeichnis

Schnellübersicht

Auf dieser Seite findest du:

  • Unicode-Konverter: Zeichen ↔ Hex, Dezimal, Binär, HTML-Entities
  • Interaktive Tabelle: Alle Unicode-Zeichen mit Namen und Werten
  • Unicode-Blöcke: Übersicht über die wichtigsten Bereiche
  • Zeichenanalyse: Detaillierte Informationen zu jedem Zeichen
  • Geschichte: Die Entwicklung von Unicode
  • FAQ: Häufige Fragen zu Unicode

1. Unicode-Konverter

Gib einen Text ein oder einen Unicode-Wert – das Tool konvertiert in beide Richtungen.

Zeichen konvertieren

0 Zeichen
Zum Beispiel: Hallo Welt 😊
Zum Beispiel: 0048 (H), 1F60A (😊)
Mehrere Werte durch Leerzeichen oder Kommas trennen
Hex (U+XXXX)
Keine Eingabe
Dezimal
Keine Eingabe
Binär (UTF-8)
Keine Eingabe
HTML-Entity
Keine Eingabe
Zeichendetails
Gib Text oder Unicode-Wert ein

2. Die Welt von Unicode

Unicode ist der Standard für die digitale Textverarbeitung – hier die Grundlagen:

Geschichte von Unicode

Entwickelt, um die Probleme von ASCII zu lösen – nur 128 Zeichen reichten nicht für alle Schriftsysteme der Welt.

1991: Unicode 1.0 mit ~7.000 Zeichen

Heute: Über 149.000 Zeichen in Version 15.1

Aufbau von Unicode

Jedes Zeichen hat einen eindeutigen Codepoint (U+XXXX):

  • U+0041: 'A'
  • U+00E4: 'ä'
  • U+1F60A: '😊'

17 Ebenen × 65.536 Codepoints = 1.114.112 mögliche Zeichen

UTF-8 Codierung

Die weltweit am häufigsten verwendete Unicode-Codierung:

  • 1 Byte: ASCII-Zeichen (0-127)
  • 2 Bytes: Lateinische Sonderzeichen
  • 3 Bytes: Griechisch, Kyrillisch, Arabisch
  • 4 Bytes: Emoji, CJK-Zeichen

UTF-8 ist rückwärtskompatibel zu ASCII

Unicode-Ebenen (Planes)

Die 17 Ebenen von Unicode:

  • Plane 0 (BMP): U+0000 bis U+FFFF – die wichtigsten Zeichen
  • Plane 1 (SMP): U+10000 bis U+1FFFF – Historische Schriften, Emoji
  • Plane 2 (SIP): U+20000 bis U+2FFFF – CJK-Erweiterungen
  • Planes 3-16: Reserviert für zukünftige Nutzung

3. Die Geschichte von Unicode

Von ASCII zu Unicode – die Entwicklung der Zeichencodierung:

1963

ASCII wird geboren

7-Bit-Code mit 128 Zeichen – nur für amerikanische Buchstaben. Grundlage für die digitale Textverarbeitung.

1980er

Das Kodierungs-Chaos

Verschiedene Codepages (Windows-1252, ISO-8859-1, KOI8-R) führen zu Problemen beim Datenaustausch. Kein System kann alle Sprachen darstellen.

1991

Unicode 1.0

Joe Becker, Mark Davis und Lee Collins veröffentlichen Unicode 1.0 mit ~7.000 Zeichen – einheitlicher Standard für alle Schriftsysteme.

1993

UTF-8 wird geboren

Ken Thompson und Rob Pike entwickeln UTF-8 – die variable Byte-Codierung, die ASCII rückwärtskompatibel macht.

2003

UTF-8 wird zum Web-Standard

UTF-8 verdrängt andere Codierungen und wird zum Standard für HTML, XML und JSON.

Heute

Unicode 15.1

Über 149.000 Zeichen, alle Schriftsysteme der Welt, Emoji und historische Schriften – der universelle Standard.

6. FAQ – Häufige Fragen

Häufige Fragen zu Unicode

Was ist der Unterschied zwischen ASCII und Unicode?

ASCII: 7-Bit-Code mit 128 Zeichen (0-127) – nur amerikanische Buchstaben, Zahlen und Steuerzeichen.

Unicode: Universeller Standard mit über 149.000 Zeichen – deckt alle Schriftsysteme der Welt ab.

Wichtig: Die ersten 128 Unicode-Zeichen sind identisch mit ASCII. So bleibt ASCII als Untermenge von Unicode erhalten.

Was ist UTF-8 und warum wird es verwendet?

UTF-8 ist die weltweit am häufigsten verwendete Unicode-Codierung.

Eigenschaften:

  • Variable Länge: 1-4 Bytes pro Zeichen
  • ASCII-kompatibel: Die ersten 128 Zeichen sind identisch mit ASCII
  • Platzsparend: Für lateinische Texte nur 1 Byte pro Zeichen
  • Standard: HTML, JSON, XML und die meisten modernen Systeme verwenden UTF-8
Was ist ein Unicode-Codepoint?

Ein Unicode-Codepoint ist die eindeutige Nummer eines Zeichens im Unicode-Standard.

Format: U+XXXX (Hexadezimal)

Beispiele:

  • U+0041 = 'A'
  • U+00E4 = 'ä'
  • U+1F60A = '😊'

Insgesamt gibt es 1.114.112 mögliche Codepoints (17 Ebenen × 65.536).

Was sind UTF-16 und UTF-32?

UTF-16:

  • Verwendet 2 oder 4 Bytes pro Zeichen
  • Wird oft in Windows, Java und JavaScript verwendet
  • Nicht ASCII-kompatibel

UTF-32:

  • Verwendet immer 4 Bytes pro Zeichen
  • Einfach zu verarbeiten, aber platzintensiv
  • Wird selten im Web verwendet

Empfehlung: Für das Web und die meisten Anwendungen ist UTF-8 die beste Wahl.

Wie viele Zeichen gibt es in Unicode?

Unicode 15.1 (September 2023) definiert 149.813 Zeichen.

Aufteilung:

  • Basic Multilingual Plane (BMP): 65.536 Zeichen (U+0000 bis U+FFFF)
  • Supplementary Planes: U+10000 bis U+10FFFF
  • Schriften: Über 160 verschiedene Schriftsysteme
  • Emoji: Über 3.600 Emoji-Zeichen

Neue Versionen werden regelmäßig veröffentlicht (ca. einmal pro Jahr).

Wie kann ich Unicode in HTML verwenden?

Es gibt mehrere Möglichkeiten, Unicode in HTML zu verwenden:

  • Direkt: Zeichen einfach in den HTML-Code schreiben (mit UTF-8-Deklaration)
  • HTML-Entity (hex): A = 'A'
  • HTML-Entity (dezimal): A = 'A'
  • Named Entity: © = '©'

Beispiel: 😊 zeigt ein 😊 an.

Was ist der Unterschied zwischen Zeichen und Glyphe?

Zeichen (Character): Die abstrakte Einheit, die durch einen Unicode-Codepoint definiert wird.

Glyphe (Glyph): Die visuelle Darstellung eines Zeichens in einer bestimmten Schriftart.

Beispiel:

  • Das Zeichen 'A' (U+0041) kann in verschiedenen Schriftarten (Times, Arial, Comic Sans) unterschiedlich aussehen.
  • Die Glyphe ist die konkrete Darstellung – die Schriftart entscheidet, wie es aussieht.
Warum sehe ich manchmal ein Quadrat (␣) statt eines Zeichens?

Ein Quadrat (␣ oder ▯) wird angezeigt, wenn:

  • Die Schriftart das Zeichen nicht unterstützt: Veraltete Schriftarten enthalten nicht alle Unicode-Zeichen
  • Das System codiert falsch: Die Zeichencodierung stimmt nicht mit der tatsächlichen Codierung überein
  • Das Zeichen ist ungültig: Es handelt sich um einen nicht definierten Codepoint

Lösung: Verwende eine moderne Schriftart mit guter Unicode-Unterstützung (z.B. Noto, Arial Unicode, Segoe UI).

Zusammenfassung

Die wichtigsten Punkte

  • Unicode: Universeller Standard für alle Schriftsysteme der Welt
  • Codepoint: Eindeutige Nummer jedes Zeichens (U+XXXX)
  • UTF-8: Die wichtigste Codierung – ASCII-kompatibel und platzsparend
  • UTF-16: Wird in Windows, Java und JavaScript verwendet
  • Emoji: Seit Unicode 6.0 (2010) Teil des Standards
  • HTML-Entities: Hex (`A`) oder dezimal (`A`)
  • Unser Tool: Konvertiert Zeichen in alle wichtigen Formate

Weitere Entwickler-Tools

ASCII-Tabelle

Die vollständige ASCII-Tabelle mit Suche, Filter und Dark Mode.

Zum Tool
Passwort-Generator

Sichere Passwörter mit einstellbarer Länge und Zeichenarten generieren.

Zum Tool
QR-Code Generator

QR-Codes für URLs, Texte, WiFi, vCards und mehr erstellen.

Zum Tool
Zahlensysteme

Lerne Binär, Hexadezimal und Oktal umzurechnen.

Zu Zahlensystemen