WIPIVERSE

ISO 639

ISO 639는 국제표준화기구(International Organization for Standardization, ISO)가 제정한 언어 표준 코드 체계이다. 이 표준은 전 세계 모든 언어에 고유한 식별자를 부여함으로써 언어 데이터를 일관되게 관리하고 교환할 수 있도록 설계되었다. ISO 639는 여러 파트로 구성되며, 주요 파트는 다음과 같다.

  1. ISO 639‑1

    • 2자리 알파벳 코드(예: en = 영어, fr = 프랑스어)로 구성된다.
    • 주로 웹, 소프트웨어 인터페이스, 국제화(i18n) 분야에서 널리 사용된다.
  2. ISO 639‑2

    • 3자리 알파벳 코드(예: eng = 영어, fra = 프랑스어)로 구성된다.
    • 도서관·학술 데이터베이스, 국제 표준 문서 등에서 활용된다.
    • 일부 언어는 두 개의 코드(“B”와 “T” 형식)를 가지고 있다(예: ger/deu).
  3. ISO 639‑3

    • 3자리 알파벳 코드 체계로, 전 세계 언어 7,000여 종을 포괄한다.
    • 언어학, 인류학, 디지털 아카이브 등에서 세부적인 언어 구분이 필요할 때 사용된다.
  4. ISO 639‑5

    • 언어 군·군집을 나타내는 3자리 코드(예: sla = 슬라브어군)이다.
    • 언어 계통학적 분류에 활용된다.
  5. ISO 639‑6 (2009년 제정, 현행에서는 사용이 제한적)

    • 4자리 알파벳 코드로, 방언·변체까지 포함한 보다 세분화된 식별을 목표로 했다.

제정 및 개정 과정

  • 최초 ISO 639 표준은 1967년 제정되었으며, 이후 1988년 ISO 639‑2, 2007년 ISO 639‑3, 2008년 ISO 639‑5, 2009년 ISO 639‑6 등으로 확장·세분화되었다.
  • 각 파트는 별도의 작업 그룹에 의해 유지·보수되며, 최신 코드 목록은 ISO 639 등록기관(예: Library of Congress, SIL International 등)에서 온라인으로 공개한다.

적용 사례

  • 웹 표준: HTML lang 속성, HTTP Content-Language 헤더 등에 ISO 639‑1 코드가 사용된다.
  • 소프트웨어: 운영체제, 애플리케이션, 모바일 앱의 다국어 지원 파일명·디렉터리 구조에 적용된다.
  • 도서관·학술: MARC 레코드, UNICODE 정의, 학술 데이터베이스의 메타데이터에 ISO 639‑2·3 코드가 활용된다.
  • 국제 기구: UN, WHO 등 다국적 조직이 보고서·통계 자료에서 언어 식별에 사용한다.

제한점

  • ISO 639‑1 코드는 전체 언어 중 약 180개에 한정되어 있어, 대부분의 언어를 식별하기 위해서는 ISO 639‑3와 같은 확장 파트를 사용해야 한다.
  • 일부 언어는 정치·사회적 요인으로 코드가 변경되거나 새롭게 부여되는 경우가 있다.

요약
ISO 639는 전 세계 언어에 대한 표준화된 알파벳 코드 체계로, 2자리(ISO 639‑1)와 3자리(ISO 639‑2, ‑3, ‑5) 코드를 통해 다양한 분야에서 언어 식별 및 데이터 교환을 지원한다. 표준은 지속적으로 유지·보수되며, 최신 코드는 공식 ISO 639 등록기관을 통해 확인할 수 있다.

둘러보기

더 찾아볼 만한 주제

    전체 문서 보기