ISO 639 ստանդարտի միավորումը և ISO 639:2023 կառուցվածքը
ISO 639 ստանդարտը երկար ժամանակ բաժանված է եղել առանձին մասերի, որոնցից հիմնականներն էին ISO 639-1-ը, ISO 639-2-ը և ISO 639-3-ը: ISO 639:2023 ստանդարտի ներդրմամբ այս առանձին մասերը փոխարինվեցին մեկ միասնականացված համակարգով, որը կազմակերպված է նույնացուցիչների հատուկ հավաքածուներով.
- Set 1 (Հավաքածու 1). Համապատասխանում է նախկին երկու տառանոց կոդերին (ISO 639-1):
- Set 2 (Հավաքածու 2). Ներառում է երեք տառանոց կոդեր, որոնք հիմնականում օգտագործվում են մատենագիտական և տերմինաբանական նպատակներով:
- Set 3 (Հավաքածու 3). Ընդգրկում է երեք տառանոց կոդերի ամբողջական ցանկը՝ աշխարհի բոլոր հայտնի անհատական լեզուները նույնականացնելու համար:
«ISO լեզվի կոդը Explorer» գործիքը հնարավորություն է տալիս հետևել այս տարբեր հավաքածուների փոխհարաբերություններին մեկ միասնական հարթակում: Այն համատեղում է Set 3-ի պաշտոնական գրանցամատյանն ու անվանական ինդեքսը Set 2-ի պաշտոնական ցանկի հետ: Գործիքի տվյալների բազան հիմնված է կոնկրետ թվագրված նմուշների վրա. Set 3 ռեեստրը, անվան ինդեքսը և մակրոլեզուների աղյուսակը թվագրված են 2026-04-14, իսկ Set 2 ցուցակը՝ 2025-09-29: Գործիքը չի ներառում շրջանառությունից հանված (թոշակի անցած) Set 3 կոդերի պատմությունը:
Որոնման համակարգի մուտքային տվյալները և սահմանափակումները
Գործիքի որոնման դաշտը, որը կրում է «Լեզվի անվանումը կամ ISO 639 կոդը» պիտակը, ընդունում է որոշակի ձևաչափերի հարցումներ: Օգտատերը կարող է մուտքագրել անգլերեն անվանումներ, համակարգի կողմից աջակցվող տեղական լեզվի անուններ կամ երկու կամ երեք տառանոց ISO 639 կոդեր: Որոնման օրինակներից են zh, chi, zho, cmn կամ cel արժեքները:
Որոնման համակարգում գործում են հետևյալ խիստ կանոններն ու սահմանափակումները.
- Նվազագույն երկարություն. Անունով որոնում կատարելու համար անհրաժեշտ է մուտքագրել առնվազն երկու տառ: Եթե մուտքագրված նիշերի քանակը պակաս է, համակարգը ցուցադրում է «Մուտքագրեք առնվազն երկու տառ՝ անունով որոնելու համար:» սխալի հաղորդագրությունը:
- Առավելագույն երկարություն. Մուտքագրված հարցումը չպետք է գերազանցի 79 նիշը: 80 կամ ավելի նիշ մուտքագրելու դեպքում հայտնվում է «Պահպանեք որոնումը 80 նիշից ցածր:» սխալը:
- Նիշերի ձևաչափ. Անվավեր նիշեր կամ սխալ ձևաչափեր կիրառելիս համակարգը ցուցադրում է «Օգտագործեք լեզվի անուն կամ երկու կամ երեք տառանոց ISO 639 կոդը:» հաղորդագրությունը:
Որոնման դաշտի կողքին առկա է «Պարզ» կոճակը, որը նախատեսված է մուտքագրված հարցումը արագ մաքրելու համար:
Տվյալների մշակումը և տեղեկատվական հաղորդագրությունները
Գործիքն աշխատում է ամբողջությամբ օգտատիրոջ դիտարկիչում (client-side): Որոնման հարցումները չեն ուղարկվում արտաքին սերվերներին, և ոչ մի տվյալ չի վերբեռնվում: Էջը բեռնելիս համակարգը ցուցադրում է «Փաթեթավորված լեզվի կոդի հղումը բեռնվում է…» կարգավիճակի հաղորդագրությունը: Եթե տվյալների բազայի բեռնումը ձախողվում է, օգտատերը տեսնում է «Փաթեթավորված տեղեկանքը չհաջողվեց բեռնել: Վերբեռնեք էջը և նորից փորձեք:» սխալը:
Որոնման արդյունքների քանակից և տեսակից կախված՝ համակարգը գեներացնում է հետևյալ ամփոփիչ հաղորդագրությունները.
| Իրավիճակ | Ցուցադրվող հաղորդագրություն |
|---|---|
| Մեկ կոդի համընկնում | «‹count› գրառումը համընկնում է «‹query›» կոդի հետ։» |
| Մեկից ավելի կոդերի համընկնում | «‹count› գրառումները համապատասխանում են «‹query›» կոդին:» |
| Մեկ լեզվի համընկնում անունով | «‹count› լեզու համապատասխանում է «‹query›»-ին:» |
| Մեկից ավելի լեզուների համընկնում անունով | «‹count› լեզու համապատասխանում է «‹query›»-ին:» |
| Ոչ մի համընկնում | «Ընթացիկ ISO 639 գրառումը չի համապատասխանում «‹query›»-ին:» |
Եթե արդյունքները չափազանց շատ են, համակարգը սահմանափակում է ցուցադրվող ցանկը և հայտնում. «Ցուցադրվում է ‹total› արդյունքների առաջին ‹shown›: Շարունակեք մուտքագրել՝ ցանկը նեղացնելու համար:»: Լռելյայն վիճակում (առանց ակտիվ որոնման) էջում ցուցադրվում են «Օրինակներ» բաժինը և «Ներկայացուցչական գրառումները ամբողջական տեղեկանքից»:
Լեզվական տվյալների դասակարգումը և կոդերի հոմանիշները
Յուրաքանչյուր լեզվական գրառման համար համակարգը տրամադրում է մանրամասն տեղեկատվություն, որը ներառում է հետևյալ դաշտերը.
- Պաշտոնական հղման անվանումը
- Այլ ինդեքսավորված անուններ
- Կոդի հարաբերություններ
- Գրանցամատյանում նշում
Շրջանակ (Scope)
Լեզվի գործառնական շրջանակը (Scope) ստանդարտում նշվում է մեկ տառով, որը գործիքում արտապատկերվում է հետևյալ կերպ.
I-> «Անհատական լեզու»M-> «Մակրոլեզու»S-> «Հատուկ ծածկագիր»C-> «Լեզվի հավաքածու»R-> «Տեղական օգտագործման տիրույթը վերապահված է»
Լեզվի տեսակ (Language type)
Լեզվի տեսակը բնութագրող կոդերը քարտեզագրվում են հետևյալ արժեքներով.
L-> «Ապրելով»E-> «Անհետացած»A-> «Հնագույն»H-> «Պատմական»C-> «Կառուցվել է»S-> «Հատուկ»
Կոդերի հոմանիշներ (Set 2/B և Set 2/T)
Set 2-ում առկա է լեզուների մի փոքր խումբ, որոնք ունեն երկու տարբեր երեք տառանոց կոդեր: Դրանք են մատենագիտական կոդը (B) և տերմինաբանական կոդը (T): Օրինակ՝ ֆրանսերենի համար Set 2/B կոդն է fre, իսկ Set 2/T կոդը՝ fra: Նման դեպքերում գործիքը ցուցադրում է երկու կոդերն էլ, իսկ Set 3-ը միշտ հետևում է տերմինաբանական (T) ձևին: Եթե որևէ կոդ ստանդարտում նշանակված չէ, այն պիտակավորվում է որպես «Նշանակված չէ»:
Մակրոլեզուներ և անդամ լեզուների կապերը
Մակրոլեզվի կառուցվածքը թույլ է տալիս մեկ ընդհանուր կոդի տակ խմբավորել սերտորեն կապված անհատական լեզուներ: Գործիքի «Մակրալեզու հարաբերություններ» դաշտը ցույց է տալիս այս կապերը երկու ուղղությամբ.
- Եթե դիտարկվող գրառումը հանդիսանում է մակրոլեզվի անդամ, ապա ցուցադրվում է հղումը ծնողական լեզվին՝ «
‹name›-ի անդամ (‹code›)» ձևաչափով: - Եթե դիտարկվող գրառումն ինքնին մակրոլեզու է, ապա համակարգը ցույց է տալիս դրա կազմում գտնվող անդամների քանակը՝ «
‹count›ընթացիկ անդամ լեզուներ» ձևաչափով:
Այս կառուցվածքի վառ օրինակ է չինարենը, որը մակրոլեզվի մակարդակում օգտագործում է zho (կամ chi) կոդը, իսկ դրա անդամ հանդիսացող մանդարին չինարենն ունի իր սեփական անհատական Set 3 կոդը՝ cmn.
Հաճախ տրվող հարցեր
Արդյո՞ք ISO 639-1, 639-2 և 639-3 ստանդարտները դեռևս առանձին են:
ISO 639:2023-ը փոխարինեց նախկին առանձին մասերը մեկ ստանդարտով, որը կազմակերպված էր նույնացուցիչների հավաքածուներով: Ծանոթ ISO 639-1, 639-2 և 639-3 անունները դեռ լայնորեն օգտագործվում են, ուստի այս հետազոտողը դրանք ցույց է տալիս ընթացիկ Set 1, Set 2 և Set 3 պիտակների կողքին:
Ինչու՞ որոշ լեզուներ ունեն երկու Set 2 կոդ:
Փոքր խումբն ունի մատենագիտական ծածկագիր (B) և տերմինաբանական ծածկագիր (T): Ֆրանսերենը, օրինակ, fre է 2/B հավաքածուում, իսկ fra՝ 2/Տ հավաքածուում: Դրանք նույն լեզվի հոմանիշներն են. 3-րդ հավաքածուն հետևում է T ձևին:
Ի՞նչ է մակրոլեզուն:
Մակրոլեզուների նույնացուցիչը խմբավորում է սերտորեն կապված առանձին լեզուներ, որոնք որոշ համատեքստերում դիտարկվում են որպես մեկ լեզու: Չինարենն օգտագործում է ժո մակրոլեզու մակարդակում, մինչդեռ մանդարին չինարենն ունի անհատական Set 3 կոդը cmn:
Կոդերի աղյուսակի ո՞ր տարբերակն է ներառված:
Էջը պիտակավորում է երկու աղբյուրի նկարները՝ Set 3 ռեեստրը, անվան ինդեքսը և մակրոլեզուների աղյուսակը թվագրված 2026-04-14, գումարած Set 2 ցուցակը թվագրված 2025-09-29: Այն ընդգրկում է ընթացիկ գրառումները, այլ ոչ թե թոշակի անցած Set 3 ծածկագրի պատմությունը: