Performance Analysis of FLsched on General Purpose Processor
Heeseung Jo · 정보과학회 컴퓨팅의 실제 논문지 · 2020
프로세서 구조가 매니코어 형태로 발전하고 있고, 한 프로세서에 집적되는 코어의 수는 지속적으로 증가하고 있다. 급속히 증가하는 인공지능과 딥러닝 워크로드는 급속히 증가하고 있고, 계산 집약적이고 매우 큰 병렬성을 요구하는 워크로드 또한 이러한 추세를 가중시키고 있다. 반면, 운영체제에서 매니코어를 지원하기 위한 스케줄러의 발전은 하드웨어 발전 속도를 따라가지 못하고 있지만, 최근 리눅스 운영체제에서 매니코어 프로세서를 고려하여 최적화된 FLsched가 제안된 바 있다. FLsched는 Xeon Phi 프로세서를 고려하여, lockless 디자인과 context switch의 수를 최소화함으로써 성능의 향상을 이루고자 한다. 본 연구에서는 FLsched가 범용 서버급 프로세서에서도 타당성을 가지는지, 성능 향상이 가능한지 분석하고 고찰해 본다. 다수의 서버급 워크로드와 벤치마크를 이용한 성능평가 결과, CFS 대비하여 FLsched가 우수한 성능을 나타내었으며, Xeon Phi에서 보다 그 성능의 향상 정도가 더 큰 것으로 나타났다. 주요한 이유로 FLsched의 lockless 디자인이 주요한 것으로 분석된다.