WIPIVERSE

레마

레마(lemma)는 언어학에서 사용되는 용어로, 굴절이 일어나는 단어의 기본형 또는 표준형을 가리킨다. 사전에서 표제어(headword)로 등재되는 형태가 바로 이 레마에 해당한다. 예를 들어 영어 동사 "running", "ran", "runs"의 레마는 "run"이며, 한국어 동사 "먹고", "먹어서", "먹었다"의 레마는 "먹다"이다.

어원적으로 레마는 고대 그리스어 λῆμμα (lēmma, '취해진 것', '명제'라는 뜻)에서 유래하였으며, 라틴어 lēmma를 거쳐 영어로 전해졌다. 본래 의미는 '전제' 또는 '보조 명제'였으나, 이후 언어학에서 '사전에 등재되는 기본형'이라는 의미로 확장되어 사용되었다.

언어학에서 레마는 형태론(morphology)과 사전 편찬(lexicography)의 핵심 개념이다. 명사의 경우 일반적으로 단수 주격 형태가 레마가 되고, 동사의 경우 언어에 따라 원형 부정사(영어, 프랑스어 등)나 직설법 현재 능동태 1인칭 단수형(고대 그리스어, 라틴어 등)이 레마로 사용된다. 이는 언어마다 사전에서 채택하는 표제형의 관습이 다르기 때문이다.

레마는 유사한 개념인 '어휘소(lexeme)'와 구분된다. 어휘소는 추상적인 의미 단위로서 하나의 어휘소가 여러 굴절형을 포괄하는 반면, 레마는 그 어휘소를 대표하는 구체적인 표제형을 지칭한다. 전산언어학(자연어 처리)에서는 표제어 추출(lemmatization)이라는 과정을 통해 텍스트 내 단어들을 레마로 정규화하여 분석에 활용한다.

수학 분야에서는 '보조 정리'라는 뜻으로 동일한 용어(lemma)가 사용되나, 이는 언어학의 레마와는 다른 개념이다.

둘러보기

더 찾아볼 만한 주제

    전체 문서 보기