Transição para a Norma Unificada ISO 639:2023
A gestão e a identificação de línguas a nível global passaram por uma evolução estrutural significativa com a publicação da norma ISO 639:2023. Anteriormente, o sistema estava dividido em partes autónomas, conhecidas como ISO 639-1, ISO 639-2 e ISO 639-3. A norma atual unificou estas secções num único quadro de referência, organizando os antigos padrões em conjuntos de identificadores integrados.
O Explorador de códigos de língua ISO permite mapear e analisar esta transição, apresentando de forma clara a correspondência entre o Conjunto 1 (antiga ISO 639-1), o Conjunto 2 (antiga ISO 639-2) e o Conjunto 3 (antiga ISO 639-3). A referência inclui entradas atuais e não inclui o histórico de códigos retirados do Conjunto 3.
Diferenças Estruturais entre os Conjuntos 1, 2 e 3
A norma ISO 639:2023 organiza-se em conjuntos de identificadores, nomeadamente o Conjunto 1, o Conjunto 2 e o Conjunto 3. O Explorador de códigos de língua ISO permite pesquisar a referência completa e datada para compreender como estes diferentes conjuntos de identificadores se relacionam entre si.
Ao pesquisar um código, a ferramenta apresenta o campo "Relacionamento de código" (detailsLabel: Relacionamento de código) para demonstrar a ligação entre os diferentes conjuntos. Caso um código não esteja atribuído dentro da referência, o mesmo é identificado como "Não atribuído" (notAssigned: Não atribuído).
Códigos Bibliográficos (B) versus Terminológicos (T)
No Conjunto 2, existe um grupo restrito de línguas que possui dois códigos de três letras distintos. Esta dualidade divide-se em:
- Código Bibliográfico (B): Derivado historicamente do nome da língua na sua forma anglófona ou noutra língua de indexação tradicional.
- Código Terminológico (T): Criado para harmonização sistemática com base na autodenominação da língua ou na estrutura do Conjunto 3.
O caso do francês ilustra esta regra: possui o código bibliográfico fre no Conjunto 2/B e o código terminológico fra no Conjunto 2/T. O Conjunto 3 adota sistematicamente a forma terminológica (T). O explorador identifica e exibe ambos os sinónimos para evitar ambiguidades em sistemas de catalogação de bibliotecas ou bases de dados académicas.
Classificação por Escopo e Tipo de Idioma
Cada registo na base de dados da norma ISO 639 é categorizado de acordo com o seu escopo de aplicação e o tipo de idioma. O sistema realiza o mapeamento automático destas propriedades a partir dos metadados oficiais.
Escopo da Língua
O campo "Escopo" define a abrangência do identificador através do mapeamento dos seguintes códigos de controlo:
- I: Mapeado como "Língua individual".
- M: Mapeado como "Macrolinguagem".
- S: Mapeado como "Código especial".
- C: Mapeado como "Coleção de idiomas".
- R: Mapeado como "Faixa reservada de uso local".
Tipo de Idioma
O campo "Tipo de idioma" classifica a natureza histórica e social da língua através dos seguintes códigos:
- L: Mapeado como "Língua viva".
- E: Mapeado como "Extinto".
- A: Mapeado como "Antigo".
- H: Mapeado como "Histórico".
- C: Mapeado como "Construído".
- S: Mapeado como "Especial".
As faixas reservadas de uso local (R) e os códigos especiais (S) garantem que os administradores de sistemas possam estender a norma internamente sem colidir com atribuições oficiais futuras.
Relações de Macrolinguagem e Membros Individuais
Uma macrolinguagem (escopo M) é uma categoria que agrupa diferentes línguas individuais que partilham uma proximidade linguística estreita, sendo tratadas como uma única entidade em determinados contextos administrativos ou geográficos.
O explorador detalha esta hierarquia através do campo "Relacionamento de macrolinguagem". Por exemplo, o chinês é classificado como uma macrolinguagem sob o código zho. No nível individual, o chinês mandarim é identificado de forma independente no Conjunto 3 com o código cmn.
A interface apresenta estas ligações de duas formas:
- Para uma macrolinguagem, exibe o número de membros ativos através da mensagem "
‹count›idiomas dos membros atuais". - Para uma língua individual que pertença a um grupo maior, exibe a filiação direta sob o formato "Membro de
‹name›(‹code›)".
Funcionamento da Pesquisa e Validação de Dados
A pesquisa é processada localmente no navegador do utilizador, garantindo total privacidade, uma vez que a sua pesquisa fica no navegador e usa a referência versionada incluída nesta página e nada é enviado. O campo de entrada de texto, rotulado como "Nome da língua ou código ISO 639", aceita nomes de línguas em inglês, nomes locais suportados ou códigos de duas ou três letras (como zh, chi, zho, cmn ou cel).
O sistema aplica regras de validação de dados durante a digitação:
- Comprimento mínimo: Se a pesquisa por nome contiver menos de duas letras, surge o erro: "Digite pelo menos duas letras para pesquisar por nome.".
- Comprimento máximo: Se o texto inserido exceder 79 caracteres, é exibido o erro: "Mantenha a pesquisa com menos de 80 caracteres.".
- Formatos inválidos: Se forem detetados formatos incompatíveis, o sistema mostra o aviso: "Use um nome de idioma ou um código ISO 639 de duas ou três letras.".
- Falha de carregamento: Caso ocorra uma falha ao carregar a referência empacotada, surge a mensagem: "A referência empacotada não pôde ser carregada. Atualize a página e tente novamente.".
Durante o carregamento inicial, a interface exibe "A carregar a referência de códigos de língua incluída…". Em estado de repouso, apresenta a secção "Exemplos"e "Entradas representativas da referência completa". Os resultados da pesquisa são acompanhados por mensagens de resumo dinâmicas, tais como "O registro ‹count› corresponde ao código “‹query›”.", "‹count› registros correspondem ao código “‹query›”.", "‹count› idioma corresponde a “‹query›”.", "‹count› idiomas correspondem a “‹query›”."ou "Nenhum registro ISO 639 atual corresponde a “‹query›”.". Se a lista de resultados for muito extensa, o sistema exibe: "Mostrando os primeiros ‹shown› de ‹total› resultados. Continue digitando para restringir a lista.".
Perguntas Frequentes
As ISO 639-1, 639-2 e 639-3 ainda são padrões separados?
A ISO 639:2023 substituiu as antigas partes separadas por um padrão organizado em conjuntos de identificadores. Os nomes familiares ISO 639-1, 639-2 e 639-3 ainda são amplamente utilizados, por isso este explorador os mostra junto com os rótulos atuais do Conjunto 1, Conjunto 2 e Conjunto 3.
Por que alguns idiomas têm dois códigos do Conjunto 2?
Um pequeno grupo possui um código bibliográfico (B) e um código terminológico (T). O francês, por exemplo, é fre no Conjunto 2/B e fra no Conjunto 2/T. São sinônimos do mesmo idioma; O conjunto 3 segue a forma T.
O que é uma macrolinguagem?
Um identificador de macrolinguagem agrupa idiomas individuais intimamente relacionados que são tratados como um idioma em alguns contextos. O chinês usa zho no nível da macrolinguagem, enquanto o chinês mandarim tem o código individual do Conjunto 3 cmn.
Qual versão da tabela de códigos está incluída?
A página rotula ambos os instantâneos de origem: o registro do Conjunto 3, índice de nomes e tabela de macrolinguagem datada de 14/04/2026, além da lista do Conjunto 2 datada de 29/09/2025. Abrange entradas atuais, não o histórico de código do Conjunto 3 retirado.