检索规则说明:AND代表“并且”;OR代表“或者”;NOT代表“不包含”;(注意必须大写,运算符两边需空一格)
检 索 范 例 :范例一: (K=图书馆学 OR K=情报学) AND A=范并思 范例二:J=计算机应用与软件 AND (U=C++ OR U=Basic) NOT M=Visual
作 者:纪相存 李大林 彭晓东 Ji Xiangcun;Li Dalin;Peng Xiaodong(National Space Science Center,Chinese Academy of Science,Beijing 101499,China;University of Chinese Academy of Science,Beijing 100049,China)
机构地区:[1]中国科学院国家空间科学中心,北京101499 [2]中国科学院大学,北京100049
出 处:《计算机应用与软件》2024年第7期184-191,共8页Computer Applications and Software
摘 要:自然语言转SQL语句技术可以帮助用户使用数据库,而WikiSQL数据集对表格内容的保护一定程度上限制了模型的使用,基于此,提出一种融合字段类型与文本匹配的中文问句解析方法。基于SQL结构分解问句解析任务,通过字段类型相关的分隔符将表结构信息结合到RoBERTa编码器输入中,并使用结合编辑距离与语义词典的文本匹配来使模型更加鲁棒。在中文数据集TableQA进行测试,该方法取得了最好的效果,正确率达到93.44%。Translating natural language questions to SQL statements can help more users to obtain what they want from the database.The protection of table content by the English dataset WikiSQL limits the migration and use of the model to a certain extent.In order to solve this problem,this paper proposes a Chinese question parsing methods combining the field types with text matching.The task was decomposed based on the SQL structure.The table structure information was combined into the input of the Roberta encoder through the column separators related to the field types.The text matching method combining the edit distance and semantic dictionary was used to make the model more robust.This method was tested on the more difficult Chinese dataset TableQA.The accuracy rate was up to 93.44%and the result verified that the method was efficient.
关 键 词:自然语言转SQL语句 表结构信息 SQL结构 文本匹配
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在链接到云南高校图书馆文献保障联盟下载...
云南高校图书馆联盟文献共享服务平台 版权所有©
您的IP:18.221.133.22