检索规则说明:AND代表“并且”;OR代表“或者”;NOT代表“不包含”;(注意必须大写,运算符两边需空一格)
检 索 范 例 :范例一: (K=图书馆学 OR K=情报学) AND A=范并思 范例二:J=计算机应用与软件 AND (U=C++ OR U=Basic) NOT M=Visual
机构地区:[1]上海交通大学信息与控制工程系,硕士研究生上海200240
出 处:《微型电脑应用》2002年第1期13-15,共3页Microcomputer Applications
摘 要:本文首先提出一种对中文句子进行分词预处理的方法 ,在预处理过程中就能完成分词过程中所有的数据库访问操作 ,这种方法可以不加修改地应用于所有机械分词算法以及消除歧义 ;然后在预处理的基础上实现一种改进的MM法 ,更加完全地遵照“长词优先”的原则 ,使分词系统在机械分词阶段能有比In this paper, a pretreatment method for Chinese word segmentation is introduced. Using it, all operations of access to the database in the segmentation process tare completed in the pretreatment phase. This method can also be used for algorithms of automatic segmentation and ambiguity diminishing. Then this paper proposes an improved Maximum Matching Method (MM) based on the pretreatment method, which achieves better effects based on the principle of ″Longer Word First″.
分 类 号:TP391.1[自动化与计算机技术—计算机应用技术]
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在链接到云南高校图书馆文献保障联盟下载...
云南高校图书馆联盟文献共享服务平台 版权所有©
您的IP:216.73.216.117