检索规则说明:AND代表“并且”;OR代表“或者”;NOT代表“不包含”;(注意必须大写,运算符两边需空一格)
检 索 范 例 :范例一: (K=图书馆学 OR K=情报学) AND A=范并思 范例二:J=计算机应用与软件 AND (U=C++ OR U=Basic) NOT M=Visual
作 者:麦合甫热提[1] 艾山.吾买尔[2] 麦热哈巴.艾力[2] 吐尔根.伊布拉音 张健
机构地区:[1]新疆大学教务处,新疆乌鲁木齐830046 [2]新疆大学信息科学与工程学院,新疆乌鲁木齐830046 [3]新疆虹联软件责任公司,新疆乌鲁木齐830002
出 处:《中文信息学报》2014年第2期66-71,共6页Journal of Chinese Information Processing
基 金:国家重点基础研究计划973(2011211B07);国家自然科学基金(61262060;61063043);国家自然科学基金(61063026);国家创新基金(10C26226505485);国家社会科学基金重点项目(10AYY006)
摘 要:该文通过研究国内外相关的拼写错误查错和纠错方法的理论,再结合维吾尔语自身的特点,提出了基于词典和统计相结合的维吾尔语拼写查错方法。首先,提出基于词典的方法进行词库和词干提取的拼写检查;其次,提出基于N元语法的词缀连接有效性判断模型,对未登录词提出基于N元语法的拼写检查模型;最后,结合以上几种方法各自的优点提出基于混合策略的拼写检查方法,该方法在准确性和检查结果可靠性等方面得到了较显著的提高。In this paper, we present spelling check method of Uyghur Languages based on a combination of dictiona- ry and statistics. Firstly, we describe a stemming method based on the dictionary. Secondly, we proposed N-gram- based model to judge the suffix to a stem, detecting the misspelling unknown words at the same time. Finally, we present a spelling check method based a hybrid strategy of combining different methods. This method achieves im- provements in accuracy, reliability, and so on.
分 类 号:TP391[自动化与计算机技术—计算机应用技术]
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在链接到云南高校图书馆文献保障联盟下载...
云南高校图书馆联盟文献共享服务平台 版权所有©
您的IP:216.73.216.112