識別方法是整個系統(tǒng)的核心。用于畫冊印刷漢字識別的模式識別方法可以大致分為結(jié)構(gòu)模式識別、統(tǒng)計模式識別及兩者的結(jié)合。下面分別進(jìn)行介紹。
結(jié)構(gòu)模式識別
漢字是一種特殊的模式,其結(jié)構(gòu)畫冊印刷雖然比較復(fù)雜,但具有相當(dāng)嚴(yán)格的規(guī)律性。換言之,漢字圖形含有豐富的結(jié)構(gòu)信息,可以設(shè)法提取含有這種信息的結(jié)構(gòu)特征及其組字規(guī)律,作為識別漢字的依據(jù),這就是結(jié)構(gòu)模式識別。
結(jié)構(gòu)模式識別是早期漢字識別研究的主要方法。其主要出發(fā)點是漢字的組成結(jié)構(gòu)。從漢字的構(gòu)成上講,漢字是由筆劃(點橫豎撇捺等)、偏旁部首構(gòu)成的;還可以認(rèn)為漢字是由更小的結(jié)構(gòu)基元構(gòu)成的。由這些結(jié)構(gòu)基元及其相互關(guān)系完全可以精確地對漢字加以描述,就像一篇文章由單字、詞、短語和句子按語法規(guī)律所組成一樣。所以這種方法也叫句法模式識別。識別時,利用上述結(jié)構(gòu)信息及句法分析的方法進(jìn)行識別,類似一個邏輯推理器。
用這種方法來描述漢字字形結(jié)構(gòu)在理論上是比較恰當(dāng)?shù),其主要?yōu)點在于對字體變化的適應(yīng)性強(qiáng),區(qū)分相似字能力強(qiáng);但是,在實際應(yīng)用中,面臨的主要問題是抗干擾能力差,因為在實際得到的文本圖象中存在著各種干擾,如傾斜,扭曲,斷裂,粘連,紙張上的污點,對比度差等等。這些因素直接影響到結(jié)構(gòu)基元的提取,假如結(jié)構(gòu)基元不能準(zhǔn)確地得到,后面的推理過程就成了無源之水。此外結(jié)構(gòu)模式識別的描述比較復(fù)雜,匹配過程的復(fù)雜度因而也較高。所以在印刷體漢字識別領(lǐng)域中,純結(jié)構(gòu)模式識別方法已經(jīng)逐漸衰落,句法識別的方法正日益受到挑戰(zhàn)。
統(tǒng)計模式識別
統(tǒng)計決策論發(fā)展較早,理論也較成熟。其要點是提取待識別模式的的一組統(tǒng)計特征,然后按照一定準(zhǔn)則所確定的決策函數(shù)進(jìn)行分類判決。
漢字的統(tǒng)計模式識別是將字符點陣看作一個整體,其所用的特征是從這個整體上經(jīng)過大量的統(tǒng)計而得到的。統(tǒng)計特征的特點是抗干擾性強(qiáng),匹配與分類的算法簡單,易于實現(xiàn)。不足之處在于細(xì)分能力較弱,區(qū)分相似字的能力差一些。常見的統(tǒng)計模式識別方法有:
(1) 模板匹配。模板匹配并不需要特征提取過程。字符的圖象直接作為特征,與字典中的模板相比,相似度最高的模板類即為識別結(jié)果。這種方法簡單易行,可以并行處理;但是一個模板只能識別同樣大小、同種字體的字符,對于傾斜、筆劃變粗變細(xì)均無良好的適應(yīng)能力。
(2)利用畫冊印刷變換特征的方法。對字符圖象進(jìn)行二進(jìn)制變換(如Walsh, Hardama變換)或更復(fù)雜的變換(如Karhunen-Loeve, Fourier,Cosine,Slant變換等),變換后的特征的維數(shù)大大降低。但是這些變換不是旋轉(zhuǎn)不變的,因此對于傾斜變形的字符的識別會有較大的偏差。二進(jìn)制變換的計算雖然簡單,但變換后的特征沒有明顯的物理意義。K-L變換雖然從最小均方誤差角度來說是最佳的,但是運算量太大,難以實用。
總之,變換特征的運算復(fù)雜度較