統一標準與識別碼集對照
ISO 639 語言代碼標準已從以往獨立的各個部分(ISO 639-1、ISO 639-2 及 ISO 639-3),過渡並整合為統一的 ISO 639:2023 標準。新標準不再以分開的冊本劃分,而是改為按識別碼集(Identifier Sets)來組織。
在現行架構中,各個識別碼集之間的對應關係如下:
- Set 1:對應以往的雙字母代碼(ISO 639-1),用於主要語言。
- Set 2:三字母代碼,當中包含書目(Bibliographic,簡稱 B)與術語(Terminology,簡稱 T)兩套變體。
- Set 3:三字母代碼,旨在涵蓋所有已知的人類語言,並採用 Set 2 的 T 形式作為基礎。
「ISO 語言代碼瀏覽器」提供了一個整合的查詢介面,將官方 Set 3 註冊表、名稱索引與官方 Set 2 清單合併為單一的版本化快照。這讓軟件開發人員、本地化工程師、語言學家及數據庫管理員能夠在同一個工具中,追蹤並驗證不同代碼集之間的關聯。
搜尋輸入規範與錯誤處理
使用者可在標示為「語言名稱或 ISO 639 代碼」的輸入框中輸入查詢內容。系統支援的輸入格式包括英文語言名稱、瀏覽器支援的本地語言名稱,或是雙字母及三字母的 ISO 639 代碼(例如:zh、chi、zho、cmn 或 cel)。
為了確保查詢準確並維持系統效能,輸入框設有以下限制與對應的錯誤提示:
- 字數下限:若按名稱搜尋,輸入長度必須至少為兩個字母。若少於兩個字母,系統會顯示錯誤訊息:「至少鍵入兩個字母以按名稱搜尋。」
- 字數上限:輸入內容總長度必須在 80 個字元以內。若超出 79 個字元,系統會顯示錯誤訊息:「將搜尋字元數控制在 80 個以內。」
- 格式限制:若輸入無效字元或不符合格式,系統會提示:「使用語言名稱或兩個或三個字母的 ISO 639 代碼。」
- 載入異常:若隨網頁發佈的封裝代碼表無法成功載入,系統會顯示:「無法載入打包的參考。重新載入頁面並重試。」
使用者可以隨時點擊「清除」按鈕,將搜尋輸入框清空並還原至預設狀態。
數據輸出與詳細欄位說明
當系統執行搜尋後,會根據匹配結果顯示狀態與摘要訊息。若匹配結果過多,系統會顯示:「顯示前 ‹shown› 個結果(共 ‹total› 個)。繼續輸入可收窄範圍。」 否則,系統會依據匹配類型顯示相應的數量摘要,例如「‹count›記錄與代碼「‹query›」匹配。」或「‹count›語言匹配「‹query›」。」 若無匹配項,則顯示「目前沒有符合「‹query›」的 ISO 639 記錄。」
在預設或首頁狀態下,介面會顯示「範例」以及「完整代碼表中的代表性條目」。當選取特定語言記錄時,系統會展示名為「代碼關係」的詳細欄位:
| 欄位名稱 | 說明與顯示值 |
|---|---|
| 官方參考名稱 | 官方註冊表登記的標準名稱。 |
| 其他索引名稱 | 該語言的其他已知別名。 |
| 適用範圍 | 映射自官方代碼,顯示值包括:<br>・I 映射為「個別語言」<br>・M 映射為「宏語言」<br>・S 映射為「特殊代碼」<br>・C 映射為「語言集合」<br>・R 映射為「保留本地使用範圍」。 |
| 語言類型 | 映射自官方代碼,顯示值包括:<br>・L 映射為「現存語言」<br>・E 映射為「滅絕語言」<br>・A 映射為「古代語言」<br>・H 映射為「歷史語言」<br>・C 映射為「人工語言」<br>・S 映射為「特殊」。 |
| 宏語言關係 | 顯示該條目與宏語言的隸屬關係,格式為「‹name› (‹code›) 成員」或「現時包含 ‹count› 種成員語言」。 |
| 註冊表註釋 | 官方針對該代碼條目提供的補充說明。 |
書目與術語代碼及特殊範圍
在 ISO 639-2(即現行 Set 2)中,存在一小群具有雙重代碼的語言。這類語言會同時獲分配一個書目代碼(B)和一個術語代碼(T)。例如,法文的 Set 2/B 代碼為 fre,而其 Set 2/T 代碼則為 fra。在此情況下,Set 3 標準一律採用術語代碼(T)形式(即 fra)。對於未分配代碼的範圍,系統會直接標示為「未分配」。
此外,標準中亦定義了「保留本地使用範圍」(Scope R)與「特殊代碼」(Scope S),用以處理特定系統對接或非特定語言記錄的編碼需求。
隱私與本地處理機制
本工具採用完全本地化的處理機制。使用者的搜尋查詢完全保留在個人的瀏覽器中進行,並直接與隨網頁附帶的版本化代碼表進行比對。整個查詢過程中,沒有任何數據會被上載至外部伺服器。
常見問題
ISO 639-1、639-2 和 639-3 仍然是單獨的標準嗎?
ISO 639:2023 已以一套按識別碼集組織的統一標準取代原先分開的各部分。ISO 639-1、639-2 與 639-3 這些舊稱仍很常見,因此本工具會與現行 Set 1、Set 2、Set 3 標籤一併顯示。
為什麼有些語言有兩個 Set 2 代碼?
少數語言同時有書目代碼 (B) 與術語代碼 (T)。例如,法文在 Set 2/B 是 fre,在 Set 2/T 是 fra;兩者表示同一語言,Set 3 採用 T 形式。
什麼是宏語言?
宏語言識別碼把一組密切相關、在某些情況下視為同一語言的個別語言歸在一起。中文的宏語言代碼是 zho,而普通話的個別語言 Set 3 代碼是 cmn。
本頁包含哪個版本的代碼表?
頁面標示兩份來源快照:Set 3 註冊表、名稱索引與宏語言表日期為 2026-04-14,Set 2 清單日期為 2025-09-29。資料只包含現行條目,不含已退役 Set 3 代碼的歷史記錄。