ISO 639 मानकांचे एकत्रीकरण आणि संरचना
ISO 639 मानक हे जगभरातील भाषांच्या वर्गीकरणासाठी आणि ओळखीसाठी अत्यंत महत्त्वाचे साधन आहे. पूर्वी हे मानक ISO 639-1, ISO 639-2, आणि ISO 639-3 अशा वेगवेगळ्या भागांमध्ये विभागलेले होते. नवीन ISO 639:2023 मानकाने या सर्व स्वतंत्र भागांना एकत्रित करून एकाच सुसंगत प्रणालीमध्ये आणले आहे. या नवीन संरचनेत पूर्वीच्या भागांना आता आयडेंटिफायर सेट 1, सेट 2, आणि सेट 3 असे संबोधले जाते.
या वेगवेगळ्या सेटमधील संबंध समजून घेणे सॉफ्टवेअर डेव्हलपर्स, लोकलायझेशन इंजिनिअर्स आणि डेटाबेस प्रशासकांसाठी आवश्यक असते. सेट 1 मध्ये प्रामुख्याने दोन-अक्षरी कोड समाविष्ट आहेत, तर सेट 2 आणि सेट 3 मध्ये तीन-अक्षरी कोडचा वापर केला जातो. "ISO भाषा कोड एक्सप्लोरर" हे साधन या सर्व सेटमधील परस्पर संबंध शोधण्यासाठी आणि मॅक्रोलँग्वेज व त्यांच्या अंतर्गत येणाऱ्या वैयक्तिक भाषांमधील दुवे तपासण्यासाठी एक सुलभ माध्यम प्रदान करते.
शोध प्रणाली, इनपुट मर्यादा आणि त्रुटी संदेश
या साधनामध्ये शोध घेण्यासाठी वापरकर्त्याला "भाषेचे नाव किंवा ISO 639 कोड" या लेबल असलेल्या इनपुट फील्डचा वापर करावा लागतो. शोध प्रक्रिया सुलभ करण्यासाठी खालील नियम आणि मर्यादा निश्चित केल्या आहेत:
- स्वीकृत स्वरूप: वापरकर्ते इंग्रजी भाषेची नावे, समर्थित स्थानिक भाषेची नावे किंवा दोन ते तीन अक्षरी ISO 639 कोड (उदा. zh, chi, zho, cmn, किंवा cel) वापरून शोध घेऊ शकतात.
- किमान मर्यादा: नावाने शोध घेण्यासाठी इनपुटमध्ये किमान दोन अक्षरे असणे आवश्यक आहे. जर वापरकर्त्याने दोनपेक्षा कमी अक्षरे टाइप केली, तर "नावाने शोधण्यासाठी किमान दोन अक्षरे टाइप करा." हा त्रुटी संदेश दर्शविला जातो.
- कमाल मर्यादा: शोध संज्ञा एकूण 79 वर्णांपेक्षा जास्त नसावी. इनपुट 80 किंवा त्याहून अधिक वर्णांचे झाल्यास, "शोध 80 वर्णांखाली ठेवा." हा त्रुटी संदेश दिसतो.
- अवैध वर्ण: अयोग्य स्वरूप किंवा अवैध वर्णांचा वापर केल्यास, साधन "भाषा नाव किंवा दोन-किंवा तीन-अक्षरी ISO 639 कोड वापरा." हा संदेश प्रदर्शित करते.
- साफ करण्याची क्रिया: इनपुट फील्ड रिकामे करण्यासाठी "साफ" बटण उपलब्ध आहे.
डेटा लोड करताना काही तांत्रिक अडचण आल्यास, "पॅकेज केलेला संदर्भ लोड करता आला नाही. पृष्ठ रीलोड करा आणि पुन्हा प्रयत्न करा." हा त्रुटी संदेश वापरकर्त्याला दिसतो.
शोध निकाल आणि डेटाचे वर्गीकरण
शोध प्रक्रियेदरम्यान साधन विविध स्थिती आणि परिणाम संदेश प्रदर्शित करते. सुरुवातीला "पॅकेज केलेला भाषा कोड संदर्भ लोड करत आहे..." हा संदेश दिसतो. शोध पूर्ण झाल्यावर निकालांच्या संख्येनुसार खालील संदेश दाखवले जातात:
- एका कोडच्या नोंदीसाठी: "
‹count›रेकॉर्ड कोड “‹query›” शी जुळतो." - एकापेक्षा जास्त कोडच्या नोंदींसाठी: "
‹count›रेकॉर्ड कोड “‹query›” शी जुळतात." - एका भाषेच्या शोधासाठी: "
‹count›भाषा “‹query›” शी जुळते." - एकापेक्षा जास्त भाषांच्या शोधासाठी: "
‹count›भाषा “‹query›” शी जुळतात." - निकाल न मिळाल्यास: "कोणतेही वर्तमान ISO 639 रेकॉर्ड “
‹query›” शी जुळत नाही."
मोठ्या प्रमाणात निकाल असल्यास, साधन "‹total› परिणामांपैकी पहिले ‹shown› दाखवत आहे. सूची अरुंद करण्यासाठी टाइप करत रहा." असा संदेश दर्शवते. डीफॉल्ट स्थितीत, हे साधन "उदाहरणे" आणि "संपूर्ण संदर्भातून प्रातिनिधिक नोंदी" प्रदर्शित करते.
तपशीलवार रेकॉर्ड फील्ड आणि कोडचे वर्गीकरण
प्रत्येक भाषेच्या रेकॉर्डमध्ये "कोड संबंध" या शीर्षकाखाली सविस्तर माहिती दिली जाते. यामध्ये खालील फील्ड्सचा समावेश असतो:
- अधिकृत संदर्भ नाव: मानकातील भाषेचे अधिकृत नाव.
- इतर अनुक्रमित नावे: भाषेची इतर पर्यायी नावे.
- रेजिस्ट्री नोट: विशिष्ट नोंदींविषयीची अतिरिक्त माहिती.
व्याप्ती (Scope)
नोंदीच्या व्याप्तीनुसार (Scope) खालील वर्गीकरण केले जाते:
Iहे "वैयक्तिक भाषा" म्हणून मॅप केले जाते.Mहे "मॅक्रोलँग्वेज" म्हणून मॅप केले जाते.Sहे "विशेष कोड" म्हणून मॅप केले जाते.Cहे "भाषा संग्रह" म्हणून मॅप केले जाते.Rहे "आरक्षित स्थानिक-वापर श्रेणी" म्हणून मॅप केले जाते.
भाषेचा प्रकार (Language Type)
भाषेच्या ऐतिहासिक आणि व्यावहारिक स्थितीनुसार खालील प्रकार दर्शविले जातात:
Lहे "जगणे" (Living) म्हणून मॅप केले जाते.Eहे "नामशेष" (Extinct) म्हणून मॅप केले जाते.Aहे "प्राचीन" (Ancient) म्हणून मॅप केले जाते.Hहे "ऐतिहासिक" (Historical) म्हणून मॅप केले जाते.Cहे "बांधले" (Constructed) म्हणून मॅप केले जाते.Sहे "विशेष" (Special) म्हणून मॅप केले जाते.
मॅक्रोलँग्वेज संबंध आणि ग्रंथसूची विरुद्ध शब्दावली कोड
ISO 639 मानकामध्ये काही भाषांना मॅक्रोलँग्वेज अंतर्गत वर्गीकृत केले जाते. जेव्हा एखादी भाषा मॅक्रोलँग्वेजचा भाग असते, तेव्हा साधन "मॅक्रोलँग्वेज संबंध" अंतर्गत "‹name› (‹code›) चे सदस्य" असे दर्शवते. याउलट, मुख्य मॅक्रोलँग्वेजच्या रेकॉर्डमध्ये "‹count› वर्तमान सदस्य भाषा" अशी माहिती दिली जाते.
काही विशिष्ट भाषांसाठी सेट 2 मध्ये दोन वेगळे कोड अस्तित्वात आहेत. यामध्ये ग्रंथसूची कोड (B - Bibliographic) आणि शब्दावली कोड (T - Terminology) यांचा समावेश होतो. उदाहरणार्थ, फ्रेंच भाषेसाठी सेट 2/B मध्ये fre हा कोड आहे, तर सेट 2/T मध्ये fra हा कोड आहे. अशा प्रकरणांमध्ये हे साधन दोन्ही कोड प्रदर्शित करते, तर सेट 3 हा नेहमी शब्दावली (T) फॉर्मचाच अवलंब करतो. जर एखादा कोड मानकात नियुक्त केलेला नसेल, तर तिथे "नियुक्त केलेले नाही" असे दर्शविले जाते.
गोपनीयता आणि डेटा प्रक्रिया
या साधनामध्ये सुरक्षिततेला आणि गोपनीयतेला प्राधान्य दिले गेले आहे. वापरकर्त्याने प्रविष्ट केलेली कोणतीही शोध संज्ञा किंवा माहिती कोणत्याही बाह्य सर्व्हरवर अपलोड केली जात नाही. संपूर्ण शोध प्रक्रिया वापरकर्त्याच्या स्वतःच्या ब्राउझरमध्येच पार पडते. हे साधन पृष्ठासोबत पाठवलेला आवृत्ती संदर्भ (packaged snapshot) वापरून स्थानिक पातळीवरच प्रक्रिया करते.
पृष्ठाच्या शेवटी "अधिकृत कोड टेबल" या शीर्षकाखाली स्त्रोत माहिती दिली जाते. यामध्ये "ISO 639:2023 · सेट 3 ‹set3Date› · सेट 2 ‹set2Date› · ‹count› रेकॉर्ड" अशा स्वरूपात मेटाडेटा दर्शविला जातो. हा पॅकेज केलेला स्नॅपशॉट अधिकृत सेट 3 रजिस्ट्री आणि नेम इंडेक्सला अधिकृत सेट 2 सूचीसह एकत्र करतो. ब्राउझरद्वारे प्रदान केलेली स्थानिक नावे केवळ शोध सुलभ करण्यासाठी वापरली जातात, तर अधिकृत संदर्भ नाव नेहमी मूळ स्वरूपात दृश्यमान राहते. या साधनामध्ये केवळ वर्तमान नोंदींचा समावेश असून, सेवानिवृत्त झालेल्या सेट 3 कोडचा इतिहास यात समाविष्ट नाही.
वारंवार विचारले जाणारे प्रश्न (FAQ)
प्रश्न: ISO 639-1, 639-2 आणि 639-3 अजूनही वेगळी मानके आहेत का?
उत्तर: ISO 639:2023 ने पूर्वीचे वेगळे भाग बदलून आयडेंटिफायर सेटमध्ये एक मानक आयोजित केले. ISO 639-1, 639-2 आणि 639-3 ही परिचित नावे अजूनही मोठ्या प्रमाणावर वापरली जातात, म्हणून हा एक्सप्लोरर त्यांना सध्याच्या सेट 1, सेट 2 आणि सेट 3 लेबल्सच्या बाजूने दाखवतो.
प्रश्न: काही भाषांमध्ये दोन सेट 2 कोड का असतात?
उत्तर: एका लहान गटामध्ये ग्रंथसूची कोड (B) आणि शब्दावली कोड (T) असतो. फ्रेंच, उदाहरणार्थ, सेट 2/B मध्ये fre आहे आणि सेट 2/T मध्ये fra. ते एकाच भाषेचे समानार्थी शब्द आहेत; सेट 3 टी फॉर्मचे अनुसरण करतो.
प्रश्न: मॅक्रोलँग्वेज म्हणजे काय?
उत्तर: एक मॅक्रोलँग्वेज आयडेंटिफायर गट जवळून संबंधित वैयक्तिक भाषा ज्यांना काही संदर्भांमध्ये एक भाषा मानली जाते. चायनीज मॅक्रोलँग्वेज स्तरावर zho वापरतात, तर मंडारीन चायनीजमध्ये वैयक्तिक सेट 3 कोड cmn आहे.
प्रश्न: कोड टेबलची कोणती आवृत्ती समाविष्ट आहे?
उत्तर: पृष्ठ दोन्ही स्त्रोत स्नॅपशॉट लेबल करते: सेट 3 रजिस्ट्री, नाव अनुक्रमणिका आणि मॅक्रोलँग्वेज टेबल दिनांक 2026-04-14, तसेच सेट 2 सूची दिनांक 2025-09-29. हे वर्तमान नोंदी समाविष्ट करते, सेवानिवृत्त सेट 3 कोड इतिहास नाही.