ISO 639는 국제표준화기구(International Organization for Standardization, ISO)가 제정한 언어 표준 코드 체계이다. 이 표준은 전 세계 모든 언어에 고유한 식별자를 부여함으로써 언어 데이터를 일관되게 관리하고 교환할 수 있도록 설계되었다. ISO 639는 여러 파트로 구성되며, 주요 파트는 다음과 같다.
-
ISO 639‑1
- 2자리 알파벳 코드(예:
en= 영어,fr= 프랑스어)로 구성된다. - 주로 웹, 소프트웨어 인터페이스, 국제화(i18n) 분야에서 널리 사용된다.
- 2자리 알파벳 코드(예:
-
ISO 639‑2
- 3자리 알파벳 코드(예:
eng= 영어,fra= 프랑스어)로 구성된다. - 도서관·학술 데이터베이스, 국제 표준 문서 등에서 활용된다.
- 일부 언어는 두 개의 코드(“B”와 “T” 형식)를 가지고 있다(예:
ger/deu).
- 3자리 알파벳 코드(예:
-
ISO 639‑3
- 3자리 알파벳 코드 체계로, 전 세계 언어 7,000여 종을 포괄한다.
- 언어학, 인류학, 디지털 아카이브 등에서 세부적인 언어 구분이 필요할 때 사용된다.
-
ISO 639‑5
- 언어 군·군집을 나타내는 3자리 코드(예:
sla= 슬라브어군)이다. - 언어 계통학적 분류에 활용된다.
- 언어 군·군집을 나타내는 3자리 코드(예:
-
ISO 639‑6 (2009년 제정, 현행에서는 사용이 제한적)
- 4자리 알파벳 코드로, 방언·변체까지 포함한 보다 세분화된 식별을 목표로 했다.
제정 및 개정 과정
- 최초 ISO 639 표준은 1967년 제정되었으며, 이후 1988년 ISO 639‑2, 2007년 ISO 639‑3, 2008년 ISO 639‑5, 2009년 ISO 639‑6 등으로 확장·세분화되었다.
- 각 파트는 별도의 작업 그룹에 의해 유지·보수되며, 최신 코드 목록은 ISO 639 등록기관(예: Library of Congress, SIL International 등)에서 온라인으로 공개한다.
적용 사례
- 웹 표준: HTML
lang속성, HTTPContent-Language헤더 등에 ISO 639‑1 코드가 사용된다. - 소프트웨어: 운영체제, 애플리케이션, 모바일 앱의 다국어 지원 파일명·디렉터리 구조에 적용된다.
- 도서관·학술: MARC 레코드, UNICODE 정의, 학술 데이터베이스의 메타데이터에 ISO 639‑2·3 코드가 활용된다.
- 국제 기구: UN, WHO 등 다국적 조직이 보고서·통계 자료에서 언어 식별에 사용한다.
제한점
- ISO 639‑1 코드는 전체 언어 중 약 180개에 한정되어 있어, 대부분의 언어를 식별하기 위해서는 ISO 639‑3와 같은 확장 파트를 사용해야 한다.
- 일부 언어는 정치·사회적 요인으로 코드가 변경되거나 새롭게 부여되는 경우가 있다.
요약
ISO 639는 전 세계 언어에 대한 표준화된 알파벳 코드 체계로, 2자리(ISO 639‑1)와 3자리(ISO 639‑2, ‑3, ‑5) 코드를 통해 다양한 분야에서 언어 식별 및 데이터 교환을 지원한다. 표준은 지속적으로 유지·보수되며, 최신 코드는 공식 ISO 639 등록기관을 통해 확인할 수 있다.