检索规则说明:AND代表“并且”;OR代表“或者”;NOT代表“不包含”;(注意必须大写,运算符两边需空一格)
检 索 范 例 :范例一: (K=图书馆学 OR K=情报学) AND A=范并思 范例二:J=计算机应用与软件 AND (U=C++ OR U=Basic) NOT M=Visual
作 者:朱巧明[1] 温滔[1] 李培蜂[1] 钱培德[1]
机构地区:[1]苏州大学计算机科学与技术学院,江苏苏州215006
出 处:《小型微型计算机系统》2006年第8期1597-1600,共4页Journal of Chinese Computer Systems
基 金:江苏省高技术研究项目(BG2005020)资助;江苏省自然基金项目(BK2003030)资助;江苏省教育厅自然(04KKB320134)资助
摘 要:在分析目前分词方法的基础上提出了一种通过建立多元信息库、采用改进型的粗分算法以找出所有可能存在歧义的句子、借助于人工干预建立错误切分歧异词库等,实现汉语歧异切分的方法,通过修改、插入多元信息库中的信息量,进一步设计了一个具有自适应能力的歧义切分方法,并通过实验证明该方法能够有效改进汉语分词中错误歧义切分的结果.On the basis of the analysis of the existing algorithms of Chinese word segmentation, the article puts forward to realize Chinese word ambiguous segmentation by establishing mulit-gram library and improving the rough segmentation algorithm in order to find all sentences which have ambiguous word segmentation and establishing false segmentation ambiguous word library in virtual of manual interference. Moreover, the article designs a self-adaptive Chinese ambiguous word segmentation method based on modifying and inserting the values in the multi-gram library. It proves that the new method is able to improve effects in false ambiguous word segmentation.
分 类 号:TP391.1[自动化与计算机技术—计算机应用技术]
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在链接到云南高校图书馆文献保障联盟下载...
云南高校图书馆联盟文献共享服务平台 版权所有©
您的IP:3.133.129.9