Performance Enhancement for Data Deduplication Server Using Bloom Filter

Byungkwan Kim · The Journal of Korean Institute of Information Technology · 2014

클라우드 환경에서는 데이터 트래픽을 줄이고 저장 공간을 효율적으로 사용하기 위하여 데이터 중복 제거 기술이 필수적이다. 본 논문에서는 블룸 필터(Bloom Filter)를 이용하여 파일들의 청크 해시값을 효과적으로 필터링 하는 중복 제거 기법을 제안한다. 제안하는 방법은 파일 유사도 기법에 기반을 두고 있으며, 중복된 청크검색을 가속화하기 위해서 각 파일의 유사도 정보를 사용하였다. 특히, 각 파일에 대해서 대표 해시를 추출하고 해시값 질의를 고속화하기 위해서 블룸 필터에 값을 저장하는 방법을 사용한다. 실험을 통하여 제안하는 기법이 실행 시간에 있어서는 800MByte 데이터 처리에서 5배 정도의 성능 향상을 보이며, 유사도 처리 성능에 있어서도 5%의 정확도 향상을 얻었다.

Read the paper · More papers on PaperTik