检索规则说明:AND代表“并且”;OR代表“或者”;NOT代表“不包含”;(注意必须大写,运算符两边需空一格)
检 索 范 例 :范例一: (K=图书馆学 OR K=情报学) AND A=范并思 范例二:J=计算机应用与软件 AND (U=C++ OR U=Basic) NOT M=Visual
机构地区:[1]安徽大学计算机科学与技术学院,安徽合肥230039
出 处:《计算机技术与发展》2012年第12期101-104,共4页Computer Technology and Development
基 金:安徽省自然科学基金资助项目(11040606M133)
摘 要:当前信息数据量庞大、冗余度高,如何在自动问答系统中快速查询所需要的信息成为一个关键课题。句子相似度计算作为该领域的一个基础并且是核心的部分,一直受到人们的关注。当前的方法各有其不足之处,文中提出了一种基于成分的句子相似度计算方法。通过将句子划分为主语、谓语、宾语、定语等成分,根据知网计算各个成分间的相似度,最后将所有成分的相似度加权求和得到句子相似度。这种方法不仅能够明显提高句子相似度计算的准确率,同时也极大地降低了计算时的时空消耗,可以有效地提高自动问答系统的准确性。The current information data has large high redundancy, how to find fast the information needed in automatic question answer- ing system has become a key issue. Sentence similarity calculation as the field of the foundation and the core part,has got the attention of people. In this paper, propose a new method which is based on the composition of sentence. Divide the sentence into subject, predicate, object,attribute and other parts. Calculate the similarity weight between corresponding parts according to HowNet,and the sentence simi- larity is the summation of all the weight above by some proportion. It not only significantly improves the accuracy of sentence similarity calculation,but also greatly reduces the calculation time and space consumption,and it can effectively improve the accuracy of the auto marie question answering system.
分 类 号:TP301.6[自动化与计算机技术—计算机系统结构]
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在链接到云南高校图书馆文献保障联盟下载...
云南高校图书馆联盟文献共享服务平台 版权所有©
您的IP:216.73.216.28