New statistical method for multifont printed Tibetan/English OCR
Hua Wang, Xiaoqing Ding · Proceedings of SPIE, the International Society for Optical Engineering/Proceedings of SPIE · 2003
Tibetan optical character recognition (OCR) system plays a crucial role in the Chinese multi-language information processing system. This paper proposed a new statistical method to perform multi-font printed Tibetan/English character recognition. A robust Tibetan character recognition kernel is elaborately designed. Incorporating with previous English character recognition techniques, the recognition accuracy on a test set containing 206,100 multi-font printed characters reaches 99.67%, which shows the validity of the proposed method.