Large-Scale Extraction of N+N Nonce Words in Korean and Their Characteristics

Ye-Eun Jeong, Jinsan An, Chanyoung Lee · Korean Linguistics · 2025

본 연구는 약 25억 어절의 한국어 대규모 말뭉치를 수집하여, 균형적으로 정제 후 SoyNLP의 LRNounExtractor_v2를 활용하여 ‘N+N’형 임시어 후보군을 추출하고, 이를 형태·어휘론적 기준으로 선별한 8,165 항목의 어휘 자원을 KNWD(Korean Nonce Word Database)로 배포하였다. 해당 자료를 대상으로 2009∼2023년 시계열 말뭉치에서의 상대 빈도 추이에 따라 ‘지속적 출현형(상승형/하강형/파동형)’과 ‘일시적 출현형’으로 구분하고, 각 하위 유형의 계량적 특성과 유형별 임시어 사용 추이를 결정할 것으로 추론되는 사회·인지적 요인을 분석하였다.

Read the paper · More papers on PaperTik