Az ISO 639 szabvány egységesítése és az ISO 639:2023
Az ISO nyelvi kódok rendszere alapvető fontosságú a szoftverfejlesztők, lokalizációs szakemberek, nyelvészek és adatbázis-adminisztrátorok számára a globális nyelvi adatok pontos azonosításában és rendszerezésében. Korábban az ISO 639 szabvány több különálló részből állt (ISO 639-1, ISO 639-2 és ISO 639-3). Az ISO 639:2023 szabvány bevezetésével ezek a korábbi különálló részek egyetlen, egységesített szabvánnyá alakultak, amely azonosítókészletekbe (Set 1, Set 2 és Set 3) szervezi a nyelvi kódokat.
Az "ISO Nyelvkód Explorer" eszköz lehetővé teszi a teljes, keltezett ISO 639 hivatkozás keresését kód vagy nyelv neve alapján, miközben átláthatóvá teszi az 1., 2. és 3. halmaz (Set 1, Set 2, Set 3) egymáshoz való viszonyát, valamint a makronyelvek és az egyedi tagnyelvek közötti kapcsolatokat.
Az azonosítókészletek felépítése és a kódkapcsolatok
A szabvány különböző azonosítókészleteket használ a nyelvek reprezentálására, amelyek eltérő részletességgel és karakterhosszal működnek:
- Set 1 (1. halmaz): Kétbetűs kódok, amelyeket elsősorban a leggyakoribb, jól dokumentált nyelvekhez használnak.
- Set 2 (2. halmaz): Hárombetűs kódok. Ebben a halmazban egy kisebb nyelvcsoport esetében két különböző kódváltozat is létezik: a bibliográfiai kód (B) és a terminológiai kód (T). Például a francia nyelv kódja a Set 2/B készletben
fre, míg a Set 2/T készletbenfra. Ha egy kód nincs kiosztva a hivatkozásban, az eszköz a "Nincs hozzárendelve" jelölést alkalmazza. - Set 3 (3. halmaz): Hárombetűs kódok, amelyek a terminológiai (T) formát követik, és a világ összes ismert emberi nyelvére kiterjednek, beleértve a modern, történelmi, ősi és mesterséges nyelveket is.
Az eszköz felületén a részletes rekordok megjelenítésekor a "Kódkapcsolat" mező mutatja be, hogyan kapcsolódnak egymáshoz az egyes készletek kódjai az adott nyelv esetében.
Keresési szabályok, bemenetek és hibakezelés
Az "ISO Nyelvkód Explorer" keresőmezője a "Nyelvnév vagy ISO 639 kód" címkével van ellátva. A keresés indításához a felhasználó megadhat angol nyelvneveket, támogatott helyi nyelvneveket, vagy két- illetve hárombetűs ISO 639 kódokat (például: zh, chi, zho, cmn vagy cel). A beírt karakterek törlésére a "Világos" gomb szolgál.
A keresési folyamat során az alábbi beviteli korlátok és hibaüzenetek érvényesek:
- Név szerinti keresés minimum hossza: Ha a felhasználó kettőnél kevesebb betűt ír be név szerinti keresés során, a rendszer az "Írjon be legalább két betűt a név szerinti kereséshez." hibaüzenetet jeleníti meg.
- Maximális karakterhossz: A bemenet hossza nem haladhatja meg a 79 karaktert. A 80. karakter elérésekor a rendszer a "A keresést tartsa 80 karakter alatt." hibaüzenetet adja vissza.
- Érvénytelen formátum: Nem megfelelő karakterek vagy formátum használata esetén a "Használjon nyelvnevet vagy két- vagy hárombetűs ISO 639 kódot." figyelmeztetés jelenik meg.
- Adatbetöltési hiba: Amennyiben a beépített adatbázis betöltése meghiúsul, a felületen a "A csomagolt hivatkozást nem sikerült betölteni. Töltse be újra az oldalt, és próbálja újra." hibaüzenet olvasható.
Hatály és nyelvtípusok osztályozása
A szabványban szereplő minden egyes rekord rendelkezik egy meghatározott hatállyal (Scope) és nyelvtípussal (Language type). Az eszköz az adatbázisban található egybetűs kódokat az alábbi hivatalos kategóriákra képezi le:
Hatály kódok leképezése (Scope)
I→ "Egyéni nyelv"M→ "Makronyelv"S→ "Speciális kód"C→ "Nyelvgyűjtemény"R→ "Helyi használatra fenntartott tartomány"
Nyelvtípus kódok leképezése (Type)
L→ "Élő"E→ "Kihalt"A→ "Ősi"H→ "Történelmi"C→ "Építve"S→ "Különleges"
Makronyelvek és tagnyelvek kapcsolata
A makronyelvek olyan strukturális csoportosítások, amelyek szorosan kapcsolódó egyedi nyelveket fognak össze, amelyeket bizonyos kontextusokban egyetlen nyelvként kezelnek. Az eszközben a "Makronyelvi kapcsolat" mező mutatja meg ezt a hierarchiát.
Ha a vizsgált rekord egy egyedi tagnyelv, a felületen a "A(z) ‹name› tagja (‹code›)" felirat jelenik meg, egyértelműen azonosítva a szülő makronyelvet. Ha a megtekintett rekord maga a makronyelv, akkor a "‹count› jelenlegi tagnyelv" mező mutatja meg a hozzá tartozó egyedi nyelvek számát.
Adatfeldolgozás, adatvédelmi irányelvek és metaadatok
Az eszköz működése során kiemelt szerepet kap a kliensoldali adatfeldolgozás. A keresések teljes mértékben a felhasználó böngészőjében futnak le, az eszköz a letöltött oldallal együtt szállított verziózott hivatkozási adatbázist használja. Semmilyen keresési kifejezés vagy adat nem kerül feltöltésre külső szerverekre.
A betöltés során a "A csomagolt nyelvi kód hivatkozásának betöltése…" állapotjelző üzenet látható. Alapértelmezett állapotban a felület a "Példák" és a "Reprezentatív bejegyzések a teljes hivatkozásból" elemeket jeleníti meg.
A keresési eredmények összegzésére az alábbi rendszerüzenetek szolgálnak a találatok számától és típusától függően:
- "
‹count›rekord egyezik a „‹query›” kóddal." vagy "‹count›rekord egyezik a „‹query›” kóddal." - "
‹count›nyelv felel meg a következőnek: „‹query›”." vagy "‹count›nyelv felel meg a következőnek: „‹query›”." - Ha nincs találat: "Egyetlen jelenlegi ISO 639 rekord sem felel meg a „
‹query›” kifejezésnek." - Ha túl sok a találat: "Az
‹total›találat közül az első‹shown›megjelenítése. A lista szűkítéséhez folytassa a gépelést."
A lap alján található "Hivatalos kódtáblázatok" szekció tartalmazza a pontos verzióinformációkat az alábbi formátumban: "ISO 639:2023 · 3. beállítása ‹set3Date› · 2. beállítása ‹set2Date› · ‹count› rekord". Ez a csomagolt pillanatkép egyesíti a hivatalos Set 3 nyilvántartást és névindexet a hivatalos Set 2 listával. A böngésző által biztosított helyi nevek kizárólag keresési segédeszközként szolgálnak, a "Hivatalos hivatkozási név" és az "Egyéb indexelt nevek" mezők mindig az eredeti hivatalos adatokat mutatják. A rendszer nem tartalmazza a már visszavont Set 3 kódok előzményeit.
Gyakran Ismételt Kérdések
Az ISO 639-1, 639-2 és 639-3 továbbra is különálló szabványok?
Az ISO 639:2023 szabvány a korábbi különálló részeket egyetlen szabványra cserélte, azonosítókészletekbe rendezve. Az ismert ISO 639-1, 639-2 és 639-3 nevek még mindig széles körben használatosak, ezért ez a felfedező a jelenlegi Set 1, Set 2 és Set 3 címkék mellett jeleníti meg őket.
Miért van néhány nyelven két Set 2 kód?
Egy kis csoportnak van bibliográfiai kódja (B) és terminológiai kódja (T). A francia például fre a 2/B készletben, a fra pedig a 2/T készletben. Ugyanannak a nyelvnek a szinonimái; A 3. készlet a T formát követi.
Mi az a makronyelv?
A makronyelvi azonosító szorosan kapcsolódó egyedi nyelveket csoportosít, amelyeket egyes összefüggésekben egyetlen nyelvként kezelnek. A kínai a zho-t használja makronyelvi szinten, míg a mandarin kínai az egyéni Set 3 kódot cmn.
A kódtábla melyik verzióját tartalmazza?
Az oldal mindkét forráspillanatképet felcímkézi: a 2026-04-14-i Set 3 nyilvántartást, névindexet és makronyelvi táblázatot, valamint a 2025-09-29-i Set 2 listát. Ez a jelenlegi bejegyzéseket takarja, nem a visszavont Set 3 kódelőzményeket.