ISO-Sprachcode-Explorer

Durchsuchen Sie die vollständige datierte ISO 639-Referenz nach Code oder Sprachnamen und verfolgen Sie dann die Beziehung zwischen Satz 1, Satz 2 und Satz 3.

ISO 639 / 2023ISO 639:2023 · Satz 3 2026-04-14 · Satz 2 2025-09-29 · 7.996 Datensätze

Versuchen Sie es mit Englisch, einem unterstützten Namen in der Landessprache oder einem Code wie zh, chi, zho, cmn oder cel.

Beispiele:

Ergebnisse

Die gepackte Sprachcode-Referenz wird geladen …

Code-Beziehung

Set 1α-2
Set 2/Bα-3
Set 2/Tα-3
Set 3α-3
Offizieller Referenzname
Umfang
Sprachtyp
Die gepackte Sprachcode-Referenz wird geladen …

Ihre Suche bleibt in Ihrem Browser und verwendet die mit dieser Seite gelieferte Versionsreferenz. Es wird nichts hochgeladen.

FAQ

Sind ISO 639-1, 639-2 und 639-3 immer noch separate Standards?

ISO 639:2023 ersetzte die früheren separaten Teile durch eine in Kennungssätzen organisierte Norm. Die bekannten Namen ISO 639-1, 639-2 und 639-3 werden immer noch häufig verwendet, daher zeigt dieser Explorer sie neben den aktuellen Bezeichnungen Set 1, Set 2 und Set 3.

Warum haben einige Sprachen zwei Satz-2-Codes?

Eine kleine Gruppe verfügt über einen bibliografischen Code (B) und einen Terminologiecode (T). Französisch ist beispielsweise in Set 2/B fre und in Set 2/T fra. Sie sind Synonyme für dieselbe Sprache; Satz 3 folgt der T-Form.

Was ist eine Makrosprache?

Ein Makrosprachenbezeichner gruppiert eng verwandte Einzelsprachen, die in manchen Kontexten als eine Sprache behandelt werden. Chinesisch verwendet zho auf der Ebene der Makrosprache, während Mandarin-Chinesisch den individuellen Satz-3-Code cmn hat.

Welche Version der Codetabelle ist enthalten?

Die Seite beschriftet beide Quell-Snapshots: die Set-3-Registrierung, den Namensindex und die Makrosprachentabelle vom 14.04.2026 sowie die Set-2-Liste vom 29.09.2025. Es deckt aktuelle Einträge ab, nicht den Verlauf der zurückgezogenen Codes von Set 3.

Die Struktur der ISO-639-Codierung und der Übergang zu ISO 639:2023

Die Standardisierung von Sprachcodes ist eine fundamentale Voraussetzung für die globale Interoperabilität von Softwaresystemen, Datenbanken und Bibliothekskatalogen. Über Jahrzehnte hinweg war die Norm ISO 639 in verschiedene Teile gegliedert, die unabhängig voneinander gepflegt wurden. Die bekanntesten Teile waren ISO 639-1 (zweistellige Codes für Hauptsprachen), ISO 639-2 (dreistellige Codes für die Terminologie und Bibliographie) und ISO 639-3 (dreistellige Codes zur Abdeckung aller bekannten lebenden, ausgestorbenen, historischen und künstlichen Sprachen).

Mit der Einführung der konsolidierten Norm ISO 639:2023 wurden diese historisch gewachsenen Einzelteile in einem vereinheitlichten Standard zusammengeführt. Der ISO-Sprachcode-Explorer nutzt eine verpackte Offline-Datenbank, die diese Beziehungen direkt im Browser auflöst, ohne dass Suchanfragen an einen externen Server übertragen werden. Das Werkzeug kombiniert die offizielle Registrierungsstelle von Set 3 und den zugehörigen Namensindex mit der offiziellen Liste von Set 2. Beim Laden der Anwendung wird der Status durch die Meldung „Die gepackte Sprachcode-Referenz wird geladen …“ signalisiert. Die zugrundeliegende Datenbasis wird im Fußbereich mit Metadaten wie „ISO 639:2023 · Satz 3 ‹set3Date› · Satz 2 ‹set2Date› · ‹count› Datensätze“ präzise ausgewiesen.

Die Identifikationssets 1, 2 und 3 im Vergleich

Die verschiedenen Sets innerhalb der ISO 639 erfüllen unterschiedliche Aufgaben und weisen strukturelle Unterschiede auf, die bei der Datenintegration häufig zu Fehlern führen:

  • Set 1 (ehemals ISO 639-1): Besteht aus zweistelligen Alpha-2-Codes (z. B. zh für Chinesisch oder fr für Französisch). Dieses Set ist primär für die Kennzeichnung von Dokumenten, Webseiten und Lokalisierungsressourcen vorgesehen, deckt jedoch nur einen Bruchteil der Weltsprachen ab.
  • Set 2 (ehemals ISO 639-2): Verwendet dreistellige Alpha-3-Codes. Es wurde entwickelt, um Bibliothekssystemen und Informationsdiensten eine präzisere Kategorisierung zu ermöglichen.
  • Set 3 (ehemals ISO 639-3): Bietet eine nahezu vollständige Abdeckung aller bekannten Sprachen der Menschheit über dreistellige Alpha-3-Codes. Während Set 2 auch Sprachgruppen und Kollektionen umfasst, ist Set 3 streng auf die Identifikation von Einzelsprachen und Makrosprachen ausgelegt.

Der Explorer ermöglicht die Eingabe von Suchbegriffen im Feld „Sprachname oder ISO 639-Code“. Zulässig sind englische Bezeichnungen, unterstützte lokale Sprachnamen sowie zwei- oder dreistellige Codes (z. B. zh, chi, zho, cmn oder cel).

Die Besonderheit von Bibliographie- (B) und Terminologie-Codes (T)

Ein häufiger Stolperstein in der Praxis ist die Existenz von Code-Synonymen innerhalb von Set 2. Für eine kleine Gruppe von Sprachen existieren dort zwei unterschiedliche dreistellige Codes:

  1. Bibliographische Codes (Set 2/B): Diese basieren häufig auf dem historischen Namen der Sprache (z. B. fre für Französisch).
  2. Terminologische Codes (Set 2/T): Diese sind enger an die zweistelligen Codes angelehnt (z. B. fra für Französisch).

Set 3 folgt konsequent der terminologischen Variante (T-Form). Der Explorer löst diese Überschneidungen transparent auf. Sucht man beispielsweise nach Französisch, zeigt das System im Feld „Code-Beziehung“ sowohl den B-Code als auch den T-Code an. Ist ein Code in der Referenz nicht zugewiesen, wird er explizit als „Nicht zugewiesen“ deklariert.

Makrosprachen und die Hierarchie der Mitgliedssprachen

Ein zentrales Konzept zur Strukturierung des Sprachraums ist die Definition von Makrosprachen (Umfang-Code M). Eine Makrosprache fasst mehrere eng verwandte, aber eigenständige Einzelsprachen (Umfang-Code I) zusammen, die aus soziolinguistischen oder historischen Gründen oft als Dialekte einer einzigen Sprache wahrgenommen werden.

Ein klassisches Beispiel ist Chinesisch (zho / zh). Als Makrosprache umfasst es zahlreiche eigenständige Einzelsprachen wie Mandarin (cmn), Kantonesisch (yue) oder Hakka (hak). Der Explorer bildet diese Hierarchien über das Feld „Makrosprachbeziehung“ ab. Bei der Abfrage einer Makrosprache wird die Anzahl der aktiven Mitgliedssprachen ausgegeben (z. B. „‹count› aktuelle Mitgliedssprachen“). Sucht man hingegen nach einer spezifischen Mitgliedssprache wie cmn, verweist das System direkt auf die übergeordnete Makrosprache im Format „Mitglied von ‹name› (‹code›)“.

Klassifizierung nach Reichweite (Umfang) und Sprachtyp

Jeder Eintrag in der ISO-Datenbank ist durch eine eindeutige Kombination aus Reichweite (Umfang) und Sprachtyp (Type) gekennzeichnet. Der Explorer übersetzt die internen einstelligen Kürzel der Registrierungsstellen in verständliche Bezeichnungen:

Zuordnung der Reichweite (Umfang)

  • I wird abgebildet auf „Individuelle Sprache“ (Einzelsprache).
  • M wird abgebildet auf „Makrosprache“ (Makrosprache).
  • S wird abgebildet auf „Sondercode“ (Spezialcode für technische Ausnahmefälle).
  • C wird abgebildet auf „Sprachsammlung“ (Sprachsammlungen, die in Set 3 nicht zulässig sind).
  • R wird abgebildet auf „Reservierter lokaler Nutzungsbereich“ (für private oder proprietäre Erweiterungen reservierte Bereiche).

Zuordnung des Sprachtyps (Sprachtyp)

  • L wird abgebildet auf „Leben“ (lebende Sprachen, die aktuell von Muttersprachlern gesprochen werden).
  • E wird abgebildet auf „Ausgestorben“ (in historischer Zeit ausgestorbene Sprachen).
  • A wird abgebildet auf „Uralt“ (antike Sprachen, die vor langer Zeit ausgestorben sind, aber eine bedeutende Literatur hinterlassen haben).
  • H wird abgebildet auf „Historisch“ (historische Sprachstufen, die sich deutlich von ihren modernen Nachfolgern unterscheiden, wie Mittelhochdeutsch).
  • C wird abgebildet auf „Konstruiert“ (Plansprachen wie Esperanto oder Klingonisch).
  • S wird abgebildet auf „Speziell“ (technische Platzhalter).

Zusätzlich bietet das Feld „Registrierungsvermerk“ wichtige administrative Hinweise der Registrierungsstelle zu Besonderheiten des jeweiligen Eintrags.

Validierungsregeln und Fehlerbehandlung bei der Suche

Um eine effiziente Navigation durch die Datensätze zu gewährleisten, wendet das Tool strikte Validierungsregeln auf das Suchfeld an:

  • Mindestlänge bei Namenssuche: Wenn der Benutzer bei der Suche nach Namen weniger als zwei Buchstaben eingibt, zeigt das Tool die Fehlermeldung: „Geben Sie mindestens zwei Buchstaben ein, um nach Namen zu suchen.“.
  • Maximallänge: Wenn die Eingabe 79 Zeichen überschreitet, zeigt das Tool die Fehlermeldung: „Halten Sie die Suche auf weniger als 80 Zeichen.“.
  • Ungültige Zeichen: Bei ungültigen Zeichen oder Formaten zeigt das Tool an: „Verwenden Sie einen Sprachnamen oder einen zwei- oder dreibuchstabigen ISO 639-Code.“.
  • Ladefehler: Falls die gepackte Referenz nicht geladen werden kann, zeigt das Tool an: „Die gepackte Referenz konnte nicht geladen werden. Laden Sie die Seite neu und versuchen Sie es erneut.“.

Bei der Suche passt sich die Statusmeldung dynamisch an die Anzahl der Treffer an:

  • Wenn ein Datensatz mit dem Code übereinstimmt: „Der Datensatz „‹count›“ entspricht dem Code „‹query›“.“.
  • Wenn mehrere Datensätze mit dem Code übereinstimmen: „‹count› Datensätze stimmen mit dem Code „‹query›“ überein.“.
  • Wenn eine Sprache mit dem Namen übereinstimmt: „‹count›-Sprache stimmt mit „‹query›“ überein.“.
  • Wenn mehrere Sprachen mit dem Namen übereinstimmen: „‹count› Sprachen stimmen mit „‹query›“ überein.“.
  • Wenn kein aktueller Datensatz übereinstimmt: „Kein aktueller ISO 639-Datensatz stimmt mit „‹query›“ überein.“.
  • Bei vielen Suchergebnissen wird die Anzeige limitiert: „Zeigt die ersten ‹shown› von ‹total› Ergebnissen. Geben Sie weiter ein, um die Liste einzugrenzen.“.

Häufig gestellte Fragen (FAQ)

Warum finde ich im Explorer keine historischen Änderungen oder gelöschte Codes aus Set 3?
Der Explorer konzentriert sich ausschließlich auf die aktuellen Einträge der verpackten Snapshot-Versionen. Historische, mittlerweile zurückgezogene oder geänderte Codes aus der Historie von Set 3 sind in diesem Tool nicht enthalten.

Was bedeuten die reservierten Bereiche für den lokalen Gebrauch (Reservierter lokaler Nutzungsbereich)?
Der Bereich „Reservierter lokaler Nutzungsbereich“ kennzeichnet Codes, die für den lokalen Gebrauch reserviert sind. Diese Einstufung gehört zu den verschiedenen vordefinierten Reichweiten (Umfang) des ISO-Standards, die das Tool aus den offiziellen Tabellen ausliest und darstellt.

Wie unterscheidet das Tool zwischen offiziellen Namen und lokalen Bezeichnungen?
Das Feld „Offizieller Referenzname“ zeigt stets die standardisierte Bezeichnung der ISO-Registrierungsstelle. Lokale Sprachbezeichnungen, die vom Webbrowser bereitgestellt werden, dienen lediglich als Suchhilfe, um das Auffinden zu erleichtern; der offizielle Referenzname bleibt jedoch stets sichtbar.

Warum haben manche Sprachen zwei verschiedene dreistellige Codes in Set 2?
Dies liegt an der Unterscheidung zwischen bibliographischen (B) und terminologischen (T) Codes für eine kleine Gruppe von Sprachen. Ein Beispiel hierfür ist Französisch mit dem Code fre in Set 2/B und fra in Set 2/T, während Set 3 der T-Form folgt.