%0 Journal Article %T 基于复述的中文自然语言接口 %A 刘梦赤 %A 胡婕 %J 计算机应用 %D 2016 %R 10.11772/j.issn.1001-9081.2016.05.1290 %X 摘要 针对传统以句法分析为主的数据库自然语言接口系统识别用户语义准确率不高,且需要大量人工标注训练语料的问题,提出了一种基于复述的中文自然语言接口(NLIDB)实现方法。首先提取用户语句中表征数据库实体词,建立候选树集及对应的形式化自然语言表达;其次由网络问答语料训练得到的复述分类器筛选出语义最相近的表达;最后将相应的候选树转换为结构化查询语句(SQL)。实验表明该方法在美国地理问答语料(GeoQueries880)、餐饮问答语料(RestQueries250)上的F1值分别达到83.4%、90%,均优于句法分析方法。通过对比实验结果发现基于复述方法的数据库自然语言接口系统能更好地处理用户与数据库的语义鸿沟问题 %K 数据库自然语言接口 %K 词向量 %K 复述 %K 自然语言表达 %K 机器学习 %U http://www.joca.cn/CN/abstract/abstract19352.shtml