WIPIVERSE

유니코드 키릴 문자

유니코드 키릴 문자는 유니코드(Unicode) 표준에 정의된 키릴 문자(Cyrillic script)들을 가리키는 용어이다. 키릴 문자는 러시아어, 우크라이나어, 벨라루스어, 세르비아어(라틴 알파벳과 병행), 불가리아어, 마케도니아어 등 다수의 유럽·아시아 언어에서 쓰이며, 유니코드에 따라 고유한 코드 포인트가 할당된다.

주요 유니코드 블록

블록명 코드 포인트 범위 설명
Cyrillic U+0400–U+04FF 기본 키릴 문자 집합. 러시아어·우크라이나어·불가리아어 등에서 사용되는 대부분의 문자 포함.
Cyrillic Supplement U+0500–U+052F 추가 문자·확장 문자 포함. 예: 모스크바어·카자흐어·타타르어 등에서 사용되는 특수 문자.
Cyrillic Extended‑A U+2DE0–U+2DFF 고대 및 문서학적 형태의 문자. 예: 고대 슬라브어 표기.
Cyrillic Extended‑B U+A640–U+A69F 현대 확장 문자. 예: 카라시우·춐키프·베라루스어 등에서 사용되는 변형 문자.
Cyrillic Extended‑C U+1C80–U+1C8F 상업·역사적 문자·소수 사용 언어용 문자 포함.

인코딩 방식

키릴 문자는 유니코드의 모든 인코딩 양식(UTF‑8, UTF‑16, UTF‑32 등)에서 동일한 코드 포인트를 사용한다. 예를 들어, 문자 「А」(U+0410)는 UTF‑8에서 0xD0 0x90, UTF‑16에서 0x0410, UTF‑32에서 0x00000410으로 표현된다.

역사적 배경

  • Unicode 1.0 (1991년): 최초 버전부터 기본 Cyrillic 블록(U+0400–U+04FF)이 포함되었다.
  • 이후 버전에서 Supplement 및 Extended‑A/B/C 블록이 추가되어, 기존에 표준화되지 않은 지역·역사적 문자까지 포괄하게 되었다. 각 블록 추가 시점은 Unicode Standard 버전 기록에 명시된다(예: Cyrillic Supplement은 Unicode 3.2, Cyrillic Extended‑A는 Unicode 5.1 등).

활용

  • 운영체제·소프트웨어: 러시아어·우크라이나어·불가리아어 등 현지화 및 국제화 과정에서 필수 문자 집합.
  • : HTML·CSS·JavaScript 등에서 UTF‑8 인코딩을 사용할 경우, 키릴 문자는 별도 변환 없이 그대로 표시 가능.
  • 데이터 교환: 국제 표준 파일 형식(CSV, JSON, XML 등)에서 UTF‑8 인코딩을 활용하면 키릴 문자의 호환성이 확보된다.

참고 문서

  • The Unicode Standard, Version 15.0 (2022) – Chapter 6 “Scripts”, Section 6.3 “Cyrillic”.
  • Unicode Consortium, “Unicode Character Database (UCD)”.
  • ISO/IEC 10646: Information technology — Universal Coded Character Set (UCS).

(위 내용은 공개된 Unicode 표준 문서에 근거한 객관적 정보이며, 추가적인 출처가 필요할 경우 Unicode Consortium 공식 웹사이트를 참조한다.)

둘러보기

더 찾아볼 만한 주제

    전체 문서 보기