文本相似度计算方法研究综述

来源 :数据分析与知识发现 | 被引量 : 0次 | 上传用户:yyy8881200
下载到本地 , 更方便阅读
声明 : 本文档内容版权归属内容提供方 , 如果您对本文有版权争议 , 可与客服联系进行内容授权或下架
论文部分内容阅读
【目的】分析文本相似度计算方法,了解该领域的发展态势。【文献范围】在CNKI和Web of Science中分别以检索式"篇名:文本相似度OR篇名:词汇相似度OR篇名:语义相似度"和"TI:‘text similarity’or‘semantic similarity’or‘lexical similarity’"并限定文献类型进行检索,最终得到69篇重点文献。【方法】对文本相似度计算方法进行系统梳理,分析重点方法的基本思想、特点并总结未来发展方向。【结果】形成了较为全面的分类描述体系,文本相似度计算方法可分为4类:基于字符串的方法、基于语料库的方法、基于世界知识的方法和其他方法。其中,基于神经网络和基于世界知识的方法以及针对跨领域文本的相似度计算将成为该领域的发展趋势。【局限】仅将不同方法本身作为探讨的核心,未进一步分析方法的应用情况。【结论】有助于全面把握和深入了解文本相似度计算方法的研究现状和未来趋势。
其他文献
“三个代表”重要思想 ,是以江泽民同志为核心的党中央站在世纪交替的历史高度 ,根据国际国内形势的新变化 ,我国改革开放和现代化建设面临的新问题、新任务 ,我们党肩负的历
<正>多名购买大都会smart公寓的业主日前反映,购房时开发商保利集团承诺民水民电以及万全道小学学区房,等到收房的时候,这些条件严重缩水,业主多次找开发商希望解决,却吃了闭
期刊
<正>大多数公司会对工作时长进行管理,增加工作时长、让员工更加卖命地干活和放弃度假机会等,而非对"带宽"(有限时间里的工作效率)进行管理。其实,大约一个世纪之前,亨利·福
1999年,河南省新野县新甸津湾村农家女周春芝在庭院里养起了七彩山鸡i随着山鸡的繁殖,一批批孵化出的小山鸡在有限的场地里非常拥挤。她想到利用平房顶养山鸡。于是买来了网子
环境和资源是人类生活和发展的基本条件。随着人类经济和城市化的发展,环境污染已成为制约经济、社会发展,危及人类生存的重要因素,环境保护工作直接关系到社会经济的发展和社会
近年来,高职院大量招聘青年辅导员,很多应届毕业生都直接走上了辅导员岗位,年轻辅导员处于从“学生”到“教师”的过渡时期,其自身既有工作上的优势,同时也存在职业无力感。
1总体情况2017年2月,全国共发生房屋市政工程生产安全事故22起、死亡30人,比去年同期事故起数增加17起、死亡人数增加23人,同比分别上升340.00%和328.57%(见图1)。2017年2月,全
《道德经》虽然只有五千言,但其思想却博大精深。道家思想的理论基点是"道",整个道学理论体系是在老子所预设的"道"的基础上展开的。道有五个基本特性:自然、清静、柔弱、无