Image-based Multiple Human Action Tracking Method for Smart Space Interface
Tae-woo Han · Journal of the Korea Entertainment Industry Association · 2009
본 논문은 지능 공간과의 인터페이스로 활용하기 위한 실시간 인간 영상 추적 및 행동 인식 방법을 기술한다. 이 방법은 고정된 카메라로부터 얻어지는 일련의 영상들을 분석하여 처리함으로써 여러 사람을 동시에 추적할 수 있고 사람 각각의 행동을 인식할 수 있게 한다. 비디오 영상을 이용하여 여러 사람의 모든 행동을 인식하기 위해서는 인간의 모습이라고 가정되는 영상 내의 영역들을 추적하고 관리해야 한다. 우선 하나의 영상이 주어지면, 계층적 데이터 구조를 가지고 가우시안 혼합 모델(MOG: Mixture of Gaussian)알고리즘을 사용하여 영역들을 검출해 내야 한다. 그리고 각각의 영영들의 상태를 예측해 가면서 사람들을 추적하고 영역의 상태에 따라 각각의 영역에 사람의 외관정보를 할당해야 한다. 영역의 상태는 등장, 퇴장, 지속, 병합, 분리의 5개 상태로 구분한다. 마지막으로 모션 히스토리 영상(MHI: Motion History Image)을 사용하여 행동을 모델링하고 다층 퍼셉트론(MLP: Multi-layer Perceptron)을 사용하여 행동들을 인식한다. 제안된 방법은 실시간에 여러 사람을 추적하는 것뿐만 아니라 행동인식 및 행동 추적을 위해 인간 영역 데이터를 효율적으로 관리하는 데도 유용하다.