检索规则说明:AND代表“并且”;OR代表“或者”;NOT代表“不包含”;(注意必须大写,运算符两边需空一格)
检 索 范 例 :范例一: (K=图书馆学 OR K=情报学) AND A=范并思 范例二:J=计算机应用与软件 AND (U=C++ OR U=Basic) NOT M=Visual
作 者:党帅兵 李国臣[1,2] 王瑞波[3] 李济洪[3]
机构地区:[1]山西大学计算机与信息技术学院,山西太原030006 [2]太原工业学院计算机工程系,山西太原030008 [3]山西大学软件学院,山西太原030006
出 处:《中北大学学报(自然科学版)》2015年第3期328-332,337,共6页Journal of North University of China(Natural Science Edition)
摘 要:框架排歧目的在于根据句子中目标词的上下文环境,从现有的框架库中为该目标词自动标注一个合适的框架.将框架排歧任务看作分类问题,首次将词的低维分布表征信息作为模型特征引入到汉语框架排歧研究中,来探讨仅从词特征出发,不同的特征表示对框架排歧模型的影响.实验选取了88个词元中2 077条例句为数据集,并将目标词周围的词分布表征信息加入到最大熵算法中进行建模.实验结果表明,使用词分布表征信息的框架排歧模型可以达到58.11%的精度,该结果与传统的仅使用词特征时(47.47%)的结果相比有大幅度提高.这说明词分布表征对汉语框架排歧任务是有重要作用的.The purpose of frame disambiguation is to select a proper frame from all frames in CFN for a target word of a Chinese sentence,based on the context of the target word.Frame disambiguation is regarded as a classification task between frames,and we firstly introduce word low dimension distributed representations as features to investigate the influence of different feature representations on frame disambiguation model only proceed from the word feature.We selected 2 077 annotated sentences from 88 lexical units as our dataset,and introduced the distributed representations of words around the target word into maximum entropy algorithm for the model building.Experimental results show that the accuracy of our proposed frame disambiguation model reaches 58.11%.Compared with the result(47.47%)that only use word features,this result get increased significantly,and it shows that word distributed representations is so important to frame disambiguation.
关 键 词:框架排歧 最大熵模型 词分布表征 汉语框架语义知识库
分 类 号:TP391.1[自动化与计算机技术—计算机应用技术]
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在链接到云南高校图书馆文献保障联盟下载...
云南高校图书馆联盟文献共享服务平台 版权所有©
您的IP:18.217.93.250