Dimensionality Reduction Method without Model for Personalized Recommendation

Chan-Woo Yoo, Hee-Chern Kim · Journal of Digital Contents Society · 2020

개인화 추천을 위한 머신러닝 모델에 사용될 사용자 또는 품목에 대한 임베딩을 만들어 내기 위해서 차원 축소 기법이 널리 사용된다. 그러나 특이값 분해와 같은 모형을 사용하는 차원 축소 기법은 그 성질이 잘 알려져 있다는 장점에도 불구하고 산업계에서 발생하는 빅데이터에는 수행시간이나 메모리 측면에서 적용하기 어렵다는 단점이 있다. 이 경우에는 모형을 사용하지 않는 랜덤 투영과 같은 보다 빠르고 자원을 소모하지 않는 기법이 사용된다. 본 논문에서는 랜덤 투영과 같이 모형을 사용하지 않아 가벼운 방법이지만 랜덤 투영보다 본래 데이터 포인트 사이의 코사인 유사도를 더 잘 보존할 수 있는 방법을 제안하였다. 개인화 추천분야의 공개된 데이터셋에 대해서 실험을 한 결과 제안한 방법이 모든 차원에서 랜덤 투영보다 코사인 유사도를 더 잘 보존하고, 수행 시간 면에서도 우위에 있는 것으로 나타났다. 또한 모형을 생성하는 특이값 분해와도 비교를 수행하였는데, 제안한 방법이 일정 이상의 차원에서는 특이값 분해와 코사인 유사도 보존 측면에서 차이가 없었고, 수행 시간에서는 우위를 보였다.

Read the paper · More papers on PaperTik