File Similarity Evaluation Scheme Using Hash String

Su Jin Oh · The Journal of Korean Institute of Information Technology · 2014

파일 유사도 기법은 클라우드 환경에서 네트워크 대역폭을 줄이는데 도움을 주거나 컴퓨터 시스템에서 악성 파일을 찾아내는데 유용하게 사용될 수 있다. 하지만, 기존의 파일 유사도 탐지 알고리즘은 높은 계산량과 공간을 소모하기 때문에 문제가 되고 있다. 본 연구에서는 이와 같은 문제점을 해결하기 위해서, 고정 분할 기법과 piecewise 해시 기법을 적용한 새로운 파일 유사도 기법을 제안한다. 파일 유사도 해시 스트링을 생성하기 위해서 파일을 분할하고 각 청크의 해시값이 계산된다. 또한 해시값의 3 바이트를 추출하여 문자열을 생성함으로 주어진 파일에 대한 해시 스트링을 만들 수 있다. 제안하는 기법을 ssdeep 및 고정 분할 기법과 비교 실험하였으며 실험 결과 파일 유사도 탐지를 처리하는 수행 시간이 감소하고 정확도가 높아짐을 알 수 있었다.

Read the paper · More papers on PaperTik