统一的 ISO 639:2023 标准与标识符集
ISO 639 语言代码标准已从原先独立的分立部分(即 ISO 639-1、ISO 639-2 和 ISO 639-3)过渡到统一的 ISO 639:2023 标准。在现行标准下,语言标识符被划分为不同的“集”(Sets)来管理:
- Set 1:对应原 ISO 639-1,由两位字母代码组成,用于主要语言。
- Set 2:对应原 ISO 639-2,由三位字母代码组成。在 Set 2 中,少数语言存在双重代码现象,即区分书目代码(B)和术语代码(T)。例如,法语在 Set 2/B 中为
fre,在 Set 2/T 中为fra。 - Set 3:对应原 ISO 639-3,由三位字母代码组成,旨在覆盖世界上所有已知的人类语言。Set 3 在遇到双重代码时,统一采用 Set 2/T 的形式。
“ISO 语言代码浏览器”将这些分立的代码集整合在统一的视图中,方便用户追溯不同标识符集之间的对应关系。
宏语言与成员语言的关联
在 ISO 639 标准中,语言按照不同的“适用范围”(适用范围)和“语言类型”(Type)进行分类。其中一个核心概念是“宏语言”(宏语言)。
宏语言标识符用于将一组在结构上密切相关、但在特定场景下被视为独立语言的个别语言归为一类。例如,中文的宏语言代码是 zho,而作为其具体成员语言的普通话,其个别语言的 Set 3 代码则是 cmn。
本工具完整呈现了宏语言与成员语言之间的双向关系:
- 若查询对象为宏语言,系统会展示其“宏语言关系”并标注“当前包含
‹count›种成员语言”。 - 若查询对象为成员语言,系统则会显示其归属,即“
‹name›的成员 (‹code›)”。
语言适用范围与类型映射
工具对 ISO 639 注册表中的属性代码进行了直观的映射呈现:
适用范围(适用范围)
- I:映射为“个别语言”。
- M:映射为“宏语言”。
- S:映射为“特殊代码”。
- C:映射为“语言集合”。
- R:映射为“保留本地使用范围”。
语言类型(Type)
- L:映射为“现存语言”。
- E:映射为“灭绝语言”。
- A:映射为“古代语言”。
- H:映射为“历史语言”。
- C:映射为“人工语言”。
- S:映射为“特殊”。
对于在参考表中未分配的代码,工具会将其明确标注为“未分配”。
检索规则与输入限制
用户在“语言名称或 ISO 639 代码”输入框中输入查询内容时,系统将执行以下校验与检索逻辑:
- 输入格式:支持输入英文名称、浏览器支持的本地语言名称,或两位/三位 ISO 639 代码(例如
zh、chi、zho、cmn、cel)。 - 最小长度限制:若按名称搜索,输入必须至少包含两个字母。若少于两个字母,系统将提示错误:“至少键入两个字母以按名称搜索。”
- 最大长度限制:输入总长度必须控制在 79 个字符以内。若达到或超过 80 个字符,系统将提示错误:“将搜索字符数控制在 80 个以内。”
- 格式错误提示:若输入了无效字符或不符合规范的格式,系统将提示:“使用语言名称或两个或三个字母的 ISO 639 代码。”
- 清除操作:用户可点击“清除”按钮一键清空输入框。
数据源、版本与隐私说明
本工具的数据完全在本地浏览器中处理,不向任何外部服务器上传搜索内容。
数据版本
本工具使用打包的版本化快照,合并了以下官方数据:
- Set 3 注册表、名称索引与宏语言表:版本日期为
2026-04-14。 - Set 2 列表:版本日期为
2025-09-29。
数据局限性
本工具仅包含上述版本快照中的当前有效条目,不包含已退役的 Set 3 历史代码记录。如果本地打包的数据加载失败,系统会显示错误提示:“无法加载打包的参考。重新加载页面并重试。”