WIPIVERSE

유니코드 20000~20FFF

개념 및 정의
유니코드 20000~20FFF는 유니코드 표준에서 정의된 코드 포인트 범위 중 하나로, 보조 한자 영역(Supplementary Ideographic Plane, SIP)에 속한다. 이 범위는 U+20000부터 U+20FFF까지의 4,096개(0x1000) 연속된 문자들을 포함한다.

속한 블록
이 범위는 “CJK Unified Ideographs Extension B” 블록의 초반 부분에 해당한다. 전체 Extension B 블록은 U+20000–U+2A6DF(약 42,720자)로 정의되며, 20000~20FFF는 그 중 첫 번째 4,096자를 차지한다.

역사·제정

  • Unicode 3.1 (2001년)에서 최초로 CJK Unified Ideographs Extension B 블록이 도입되었다.
  • 해당 블록은 기존 “CJK Unified Ideographs”(U+4E00–U+9FFF)와 “Extension A”(U+3400–U+4DBF)에서 누락된 희귀 한자를 보완하기 위해 추가되었다.

문자 종류 및 용도

  • 한자(漢字): 주로 고전 문헌, 사전학, 사찰·사적 표기, 전통적인 이름 등에 사용되는 희귀·비표준 한자.
  • 동아시아 언어: 중국어(한자), 일본어(kanji), 한국어(한자) 등에서 특정 역사·문화적 맥락에서 활용될 수 있다.
  • 학술·전문 분야: 고문서 디지털화, 언어학 연구, 전통적인 서예·예술 작품의 정확한 표기를 위해 필요하다.

인코딩 특성

  • 보조 평면에 속하므로 UTF‑16에서는 서러게이트 쌍(surrogate pair)(예: \uD840\uDC00 형태)으로 인코딩된다.
  • UTF‑8에서는 4바이트 시퀀스로 표현된다(예: F0 A0 80 80).

지원 현황

  • 현대 주요 운영 체제(Windows, macOS, Linux)와 웹 브라우저, 폰트(예: Noto Sans CJK, Source Han Serif)에서 일정 수준 지원한다. 다만, 일부 구형 시스템에서는 해당 영역의 글꼴이 설치되지 않아 대체 문자(□)가 표시될 수 있다.

제한 및 주의점

  • 일반적인 일상 텍스트나 상용 문서에서는 거의 사용되지 않으며, 입력 및 표시를 위해서는 전용 입력기나 특수 문자 선택 도구가 필요하다.
  • 검색 엔진이나 일반적인 텍스트 처리 툴이 이 영역의 문자를 인식하지 못하는 경우가 있다.

요약
유니코드 20000~20FFF는 CJK Unified Ideographs Extension B 블록의 첫 부분을 이루는 보조 평면의 한자 집합이다. 주로 희귀·전통적인 한자를 포함하며, 학술·문화·디지털 보존 분야에서 활용된다. 현대 시스템에서 기술적 지원은 가능하지만 일반적인 일상 사용은 제한적이다.

둘러보기

더 찾아볼 만한 주제

    전체 문서 보기