基于词典和统计相结合的维吾尔语拼写检查方法  被引量:2

Spelling Check Method of Uyghur Languages Based on Dictionary and Statistics

在线阅读下载全文

作  者:麦合甫热提[1] 艾山.吾买尔[2] 麦热哈巴.艾力[2] 吐尔根.伊布拉音 张健 

机构地区:[1]新疆大学教务处,新疆乌鲁木齐830046 [2]新疆大学信息科学与工程学院,新疆乌鲁木齐830046 [3]新疆虹联软件责任公司,新疆乌鲁木齐830002

出  处:《中文信息学报》2014年第2期66-71,共6页Journal of Chinese Information Processing

基  金:国家重点基础研究计划973(2011211B07);国家自然科学基金(61262060;61063043);国家自然科学基金(61063026);国家创新基金(10C26226505485);国家社会科学基金重点项目(10AYY006)

摘  要:该文通过研究国内外相关的拼写错误查错和纠错方法的理论,再结合维吾尔语自身的特点,提出了基于词典和统计相结合的维吾尔语拼写查错方法。首先,提出基于词典的方法进行词库和词干提取的拼写检查;其次,提出基于N元语法的词缀连接有效性判断模型,对未登录词提出基于N元语法的拼写检查模型;最后,结合以上几种方法各自的优点提出基于混合策略的拼写检查方法,该方法在准确性和检查结果可靠性等方面得到了较显著的提高。In this paper, we present spelling check method of Uyghur Languages based on a combination of dictiona- ry and statistics. Firstly, we describe a stemming method based on the dictionary. Secondly, we proposed N-gram- based model to judge the suffix to a stem, detecting the misspelling unknown words at the same time. Finally, we present a spelling check method based a hybrid strategy of combining different methods. This method achieves im- provements in accuracy, reliability, and so on.

关 键 词:维吾尔语 拼写检查 词典 N元语法 

分 类 号:TP391[自动化与计算机技术—计算机应用技术]

 

参考文献:

正在载入数据...

 

二级参考文献:

正在载入数据...

 

耦合文献:

正在载入数据...

 

引证文献:

正在载入数据...

 

二级引证文献:

正在载入数据...

 

同被引文献:

正在载入数据...

 

相关期刊文献:

正在载入数据...

相关的主题
相关的作者对象
相关的机构对象