Переход к единому стандарту ISO 639:2023
Исторически кодирование языков опиралось на раздельные части стандарта ISO 639 (включая ISO 639-1, 639-2 и 639-3). С выходом ISO 639:2023 эти ранее независимые компоненты были объединены в единую систему, организованную в виде наборов идентификаторов. Инструмент «Обозреватель языковых кодов ISO» позволяет работать с этой интегрированной структурой, сопоставляя Набор 1, Набор 2 и Набор 3 в рамках одного интерфейса.
В процессе инициализации приложения на экране отображается системное сообщение «Загрузка упакованного справочника по языковому коду…». Если в процессе загрузки данных происходит сбой, система выводит предупреждение: «Не удалось загрузить упакованную ссылку. Перезагрузите страницу и повторите попытку.». После успешного старта пользователю по умолчанию предлагается раздел «Примеры» и блок «Репрезентативные записи из полного справочника».
Структура идентификаторов: Набор 1, Набор 2 и Набор 3
Связи между кодовыми наборами отражают эволюцию стандартов разметки. Обозреватель позволяет проследить, как различные наборы соотносятся друг с другом для каждой конкретной записи.
- Набор 1: Двухбуквенные коды, унаследованные от прежнего стандарта ISO 639-1.
- Набор 2: Трехбуквенные коды, которые могут содержать библиографические и терминологические варианты для одного и того же языка.
- Набор 3: Полный набор трехбуквенных идентификаторов, охватывающий все задокументированные языки.
Для языков, не имеющих эквивалента в конкретном наборе, выводится статус «Не назначено».
Библиографические и терминологические коды (Set 2/B и Set 2/T)
Особую группу в Наборе 2 составляют языки, имеющие два параллельных трехбуквенных кода. Это разделение обусловлено историческим сосуществованием библиографической (B) и терминологической (T) систем. Например, для французского языка библиографический код определяется как fre в Наборе 2/B, тогда как терминологический код — как fra в Наборе 2/T. Набор 3 в таких случаях всегда базируется на терминологической форме (T).
Классификация по области применения и типам языков
Каждая запись в реестре классифицируется по двум ключевым метаданным: области применения (Scope) и типу языка (Language type).
Область применения (Scope)
Система сопоставляет внутренние однобуквенные коды области применения со следующими официальными категориями:
I— «Индивидуальный язык»M— «Макроязык»S— «Специальный код»C— «Языковая коллекция»R— «Зарезервированный диапазон местного использования»
Тип языка (Language type)
Внутренние коды типов языков преобразуются в понятные категории:
L— «Жизнь»E— «Вымершие»A— «Древний»H— «Исторический»C— «Построенный»S— «Специальный»
Иерархия макроязыков и отдельных языков
Понятие макроязыка используется для объединения группы близкородственных индивидуальных языков, которые в определенных практических сценариях могут идентифицироваться как единое целое.
В детальном представлении записи за это отвечает поле «Макроязыковые отношения». Обозреватель обрабатывает эти связи в двух направлениях:
- Если выбранный элемент является макроязыком, система отображает количество входящих в него языков в формате «
‹count›текущих языков участников». - Если выбранный элемент является отдельным языком, входящим в макроязык, выводится ссылка на родительскую запись в формате «Член
‹name›(‹code›)».
Примером такого разделения служит китайский язык: на уровне макроязыка ему присвоен код zho, в то время как его конкретная ветвь (мандаринский китайский) имеет собственный индивидуальный код Набора 3 — cmn.
Правила валидации поисковых запросов
Поиск осуществляется через текстовое поле ввода с меткой «Название языка или код ISO 639». В качестве подсказки пользователю предлагается строка: «Попробуйте английский, название поддерживаемого местного языка или код, например zh, chi, zho, cmn или cel.».
При вводе запроса действуют строгие правила валидации:
- Минимальная длина: При поиске по названию необходимо ввести не менее двух символов. При нарушении этого правила выводится ошибка: «Введите не менее двух букв для поиска по имени.».
- Максимальная длина: Запрос ограничен 79 символами. Если длина ввода достигает 80 символов и более, отображается ошибка: «Держите поиск до 80 символов.».
- Допустимые символы: При вводе некорректных символов или нарушении формата система выдает предупреждение: «Используйте название языка или двух- или трехбуквенный код ISO 639.».
Обработка результатов поиска
Результаты поиска сопровождаются динамическими статусными сообщениями, которые зависят от типа совпадения и количества найденных записей:
| Сценарий поиска | Выводимое сообщение |
|---|---|
| Одиночное совпадение по коду | «Запись ‹count› соответствует коду «‹query›».» |
| Множественные совпадения по коду | «Записи: ‹count› соответствуют коду «‹query›».» |
| Одиночное совпадение по названию | «Язык: ‹count› соответствует «‹query›».» |
| Множественные совпадения по названию | «Языков: ‹count› соответствует запросу «‹query›».» |
| Отсутствие совпадений | «Ни одна текущая запись ISO 639 не соответствует «‹query›».» |
Если поисковый запрос возвращает обширный список результатов, интерфейс ограничивает первичный вывод и сообщает: «Показаны первые ‹shown› из ‹total› результатов. Продолжайте вводить текст, чтобы сузить список.». Для быстрого сброса параметров поиска предусмотрена кнопка «Очистить».
Каждая детальная карточка найденного языка содержит следующие поля:
- «Кодовые отношения»
- «Официальное справочное название»
- «Другие индексированные имена»
- «Область применения»
- «Тип языка»
- «Макроязыковые отношения»
- «Примечание реестра»
Источники данных и конфиденциальность
Поиск остается в браузере пользователя и использует версионную копию справочника, поставляемую вместе со страницей. Ничего не загружается.
В подвале страницы в блоке «Официальные кодовые таблицы» приводится метаинформация о версии используемого снимка данных в формате: «ISO 639:2023 · Набор 3 ‹set3Date› · Набор 2 ‹set2Date› · ‹count› записей».
Согласно примечанию к источнику («Этот упакованный снимок объединяет официальный реестр Набора 3 и указатель имен с официальным списком Набора 2. Локальные имена, предоставленные браузером, отображаются только в качестве средства поиска; официальное справочное название остается видимым.»), локализованные названия языков служат лишь вспомогательным инструментом для поиска, в то время как основным идентификатором остается официальное справочное наименование из реестра. База данных содержит только актуальные на момент создания снимка записи и не включает историю устаревших или отозванных кодов Набора 3.
Часто задаваемые вопросы
ISO 639-1, 639-2 и 639-3 по-прежнему являются отдельными стандартами?
ISO 639:2023 заменил прежние отдельные части одним стандартом, организованным в наборы идентификаторов. Знакомые названия ISO 639-1, 639-2 и 639-3 по-прежнему широко используются, поэтому в этом проводнике они показаны рядом с текущими метками Набора 1, Набора 2 и Набора 3.
Почему в некоторых языках есть два кода Набора 2?
Малая группа имеет библиографический код (Б) и терминологический код (Т). Например, французский язык — это «fre» в наборе 2/B и «fra» в наборе 2/T. Это синонимы одного и того же языка; Набор 3 соответствует форме T.
Что такое макроязык?
Идентификатор макроязыка группирует тесно связанные отдельные языки, которые в некоторых контекстах рассматриваются как один язык. Китайский язык использует zho на уровне макроязыка, тогда как китайский язык имеет индивидуальный код Набора 3 cmn.
Какая версия таблицы кодов включена?
На странице указаны оба исходных снимка: реестр Набора 3, индекс имен и таблица макроязыков от 14 апреля 2026 г., а также список Набора 2 от 29 сентября 2025 г.. Он охватывает текущие записи, а не историю устаревших кодов Набора 3.