유니코드 키릴 문자는 유니코드(Unicode) 표준에 정의된 키릴 문자(Cyrillic script)들을 가리키는 용어이다. 키릴 문자는 러시아어, 우크라이나어, 벨라루스어, 세르비아어(라틴 알파벳과 병행), 불가리아어, 마케도니아어 등 다수의 유럽·아시아 언어에서 쓰이며, 유니코드에 따라 고유한 코드 포인트가 할당된다.
주요 유니코드 블록
| 블록명 | 코드 포인트 범위 | 설명 |
|---|---|---|
| Cyrillic | U+0400–U+04FF | 기본 키릴 문자 집합. 러시아어·우크라이나어·불가리아어 등에서 사용되는 대부분의 문자 포함. |
| Cyrillic Supplement | U+0500–U+052F | 추가 문자·확장 문자 포함. 예: 모스크바어·카자흐어·타타르어 등에서 사용되는 특수 문자. |
| Cyrillic Extended‑A | U+2DE0–U+2DFF | 고대 및 문서학적 형태의 문자. 예: 고대 슬라브어 표기. |
| Cyrillic Extended‑B | U+A640–U+A69F | 현대 확장 문자. 예: 카라시우·춐키프·베라루스어 등에서 사용되는 변형 문자. |
| Cyrillic Extended‑C | U+1C80–U+1C8F | 상업·역사적 문자·소수 사용 언어용 문자 포함. |
인코딩 방식
키릴 문자는 유니코드의 모든 인코딩 양식(UTF‑8, UTF‑16, UTF‑32 등)에서 동일한 코드 포인트를 사용한다. 예를 들어, 문자 「А」(U+0410)는 UTF‑8에서 0xD0 0x90, UTF‑16에서 0x0410, UTF‑32에서 0x00000410으로 표현된다.
역사적 배경
- Unicode 1.0 (1991년): 최초 버전부터 기본 Cyrillic 블록(U+0400–U+04FF)이 포함되었다.
- 이후 버전에서 Supplement 및 Extended‑A/B/C 블록이 추가되어, 기존에 표준화되지 않은 지역·역사적 문자까지 포괄하게 되었다. 각 블록 추가 시점은 Unicode Standard 버전 기록에 명시된다(예: Cyrillic Supplement은 Unicode 3.2, Cyrillic Extended‑A는 Unicode 5.1 등).
활용
- 운영체제·소프트웨어: 러시아어·우크라이나어·불가리아어 등 현지화 및 국제화 과정에서 필수 문자 집합.
- 웹: HTML·CSS·JavaScript 등에서 UTF‑8 인코딩을 사용할 경우, 키릴 문자는 별도 변환 없이 그대로 표시 가능.
- 데이터 교환: 국제 표준 파일 형식(CSV, JSON, XML 등)에서 UTF‑8 인코딩을 활용하면 키릴 문자의 호환성이 확보된다.
참고 문서
- The Unicode Standard, Version 15.0 (2022) – Chapter 6 “Scripts”, Section 6.3 “Cyrillic”.
- Unicode Consortium, “Unicode Character Database (UCD)”.
- ISO/IEC 10646: Information technology — Universal Coded Character Set (UCS).
(위 내용은 공개된 Unicode 표준 문서에 근거한 객관적 정보이며, 추가적인 출처가 필요할 경우 Unicode Consortium 공식 웹사이트를 참조한다.)