|
|
|
题名
|
作者
|
年代
|
出处
|
被引量
|
| 1 | 基于词向量与TextRank的关键词提取方法显示文摘针对词汇语义的差异性对TextRank算法的影响进行了研究,提出一种基于词向量与TextRank的关键词抽取方法。利用FastText将文档集进行词向量表征,基于隐含主题分布思想和利用词汇间语义性的差异,构建TextRank的转移概率矩阵,最后进行词图的迭代计算和关键词抽取。实验结果表明,该方法的抽取效果相比于传统方法有明显提升,同时证明利用词向量能简单而有效地改善TextRank算法的性能。 | 周锦章 崔晓晖 | 2019 | 计算机应用研究2019,36,4: | 21 |
| 2 | 供需匹配视角下基于语义相似聚类的技术需求识别模型显示文摘在技术供需文本匹配视角下,提出了一种基于语义相似聚类的技术需求识别模型.首先,采集网络中技术需求文本提取关键短语;然后,建立领域专利技术转让索引库,基于需求关键短语检索出高相关专利,构建专利技术供给背景库,并对背景库中专利标题与摘要进行分词;第三,提出基于词向量的供需文本语义匹配度算法,筛选有效技术需求并进行语义相似聚类;最后,考虑技术需求对应的需求量和专利技术转让量,对聚类结果进行二维分类.以新能源领域为例进行实证,识别出有效技术需求195个,基于语义相似聚成12类,结合需求量与专利转让量,将12类技术需求分为'高需求、高转让'、'高需求、低转让'、'低需求、高转让'、'低需求、低转让'四大类.该研究为网络技术需求挖掘及供需匹配提供一种新思路. | 何喜军 张婷婷 武玉英 蒋国瑞 | 2019 | 系统工程理论与实践2019,39,2: | 15 |
| 3 | 融合BERT语义加权与网络图的关键词抽取方法显示文摘结合文档本身的结构信息与外部词语的语义信息,提出一种融合BERT词向量与TextRank的关键词抽取方法。在基于网络图的TextRank方法基础上,引入语义差异性并利用BERT词向量加权方式优化TextRank转移概率矩阵计算过程,同时通过迭代运算对文档中的词语进行综合影响力得分排序,最终提取得分最高的Top N个词语作为关键词。实验结果表明,当选取Top3、Top5、Top7和Top10个关键词时,与基于词向量聚类质心与TextRank加权的关键词抽取方法相比,该方法的平均F值提升了2.5%,关键词抽取效率更高。 | 李俊 吕学强 | 2020 | 计算机工程2020,46,9: | 12 |
| 4 | 机器英语翻译中的模糊语义最优解选取方法显示文摘针对传统最优解选择过程中使用的多目标粒子群选择方法,具有极大的局限性,最优解选择贴合性较低问题,提出针对机器英语翻译中的模糊语义最优解选取方法。建立机器英语翻译的语义模型,对机器英语翻译自然语言实现连接处理,使用模型对连接处理后的语义本体进行映射分析,翻译选定过程使用英语翻译的语义相似度计算提升语义连贯性。实验结果表明,改进选取方法选定翻译英语词汇特征匹配度较高,并且贴合性强,更适用于机器英语翻译中最优解选择。 | 曾妍 | 2018 | 现代电子技术2018,41,2: | 4 |
| 5 | 基于风险决策的文本语义分类算法显示文摘传统的文本分类多以空间向量模型为基础,采用层次分类树模型进行统计分析,该模型多数没有结合特征项语义信息,因此可能产生大量频繁语义模式,增加了分类路径。结合基本显露模式(e EP)在分类上的良好区分特性和基于最小期望风险代价的决策粗糙集模型,提出了一种阈值优化的文本语义分类算法TSCTO:在获取文档特征项频率分布表之后,首先利用粗糙集联合决策分布密度矩阵,计算最小阈值,提取满足一定阈值的高频词;然后结合语义分析与逆向文档频率方法获取基于语义类内文档频率的高频词;采用e EP分类方法获得最简模式;最后利用相似性公式和《知网》提供的语义相关度,计算文本相似性得分,利用三支决策理论对阈值进行选择。实验结果表明,TSCTO算法在文本分类的性能上有一定提升。 | 程玉胜 梁辉 王一宾 黎康 | 2016 | 计算机应用2016,36,11: | 4 |
| 6 | 微信息大数据粗糙集的近似约简显示文摘为了应对微信息舆情数据的格式复杂、价值稀疏和收集困难等大数据处理技术难题,基于隐含语义分析和粗糙集近似约简理论,设计微信息的数据区间值集和近似匹配分类算法.在不影响数据主要关联关系的原则下,提炼核心属性、消减次要属性,实现一种微信息异常主题倾向的发现方法.结果表明,该近似约简算法能在完成微信息兴趣倾向主题分类的前提下,将数据集属性大幅度缩减,提高微信息的信息挖掘效率,为微信息大数据舆情处理工作提供了新的思路和案例. | 任艳 | 2016 | 沈阳工业大学学报2016,38,3: | 4 |
| 7 | 智能答疑系统的设计与实现显示文摘教师不能有效及时的回答学生学习过程中遇到的问题,会影响学生的学习兴趣及学习效率。该文通过自然语言处理技术、模板分类技术、支持向量机技术构建智能答疑系统,对问题和答案进行分词处理、模板匹配和分类训练,自动对问题和答案进行课程类别判断。再通过余弦相似性算法对问题和答案计算相似度,返回相似度最大的答案。如用户对系统反馈答案不满意,可以将问题抛入公共问答区,来寻求其他用户帮助。系统将对用户答案进行审核,审核通过则将此问题答案对添加到题库中,使得题库中的问句不断扩充。该文是以网络论坛中的用户提问作为问题库,通过此库进行答案的反馈。测试结果表明,该系统能够很好地服务于大学生,体现出教学的智能化。 | 宋万里 卜磊 | 2017 | 电脑知识与技术2017,13,12X: | 2 |
| 8 | 基于扩充词汇链改进的关键词提取算法显示文摘关键词的准确提取在文本分类、文本聚类、信息检索等方面起着重要作用。现有的基于词汇链的关键词提取方法在计算词语相似度时,赋予第一类独立义原系数的值最大并且通过第一类独立义原相似度约束其他三类义原相似度;通过区域特征和词频提取关键词时,词语的权重依赖词汇链的长度,不能充分利用区域特征等问题。为了提高关键词的提取准确率,计算词语相似度时,用对比的两个词语每类义原个数的和与四类义原个数总和的比值大小排序后动态的获取系数取代固定系数,并且去除每类义原受到前面所有义原类的约束;提取关键词时,用词汇链的有效权重替代词汇链的长度。实验结果表明:改进后的算法较传统的算法提高了准确率。 | 王小林 朱磊 邰伟鹏 | 2017 | 苏州科技大学学报(自然科学版)2017,34,2: | 2 |
| 9 | 基于用户行为的文档关键词提取方法显示文摘对文档提取关键词时忽略在文档中出现频率不高但对文章具有关键意义的词语的问题,提出一种基于用户行为的文档关键词提取方法。利用结构熵权法为用户对文档的用户行为建模,在提取关键词时,考虑用户行为的影响和文档关键词的位置,并通过实验验证了提出的方法所提取出的关键词具有更高的准确性。 | 王燊 施运梅 | 2018 | 北京信息科技大学学报(自然科学版)2018,33,5: | 1 |
| 10 | 面向个性化站点的用户检索意图建模方法显示文摘针对个性化站点较少考虑用户检索意图的问题,提出结合交叉信息熵和词语特征信息的关键词提取方法以及结合余弦相似度和加权海明距离的文本排序方法,旨在不需要用户任何反馈的条件下,为用户推荐更满意的检索结果。通过过滤用户请求个性化站点时的访问地址,获取用户浏览的网页文本内容,从中提取能够表示用户检索意图的关键词集进行重新检索后对检索结果排序,最后将排序后的结果作为推荐模块返回给用户。实验表明,利用该方法获得的查询推荐结果能够更加符合用户检索意图,提供更好的用户体验。 | 张瑞芳 郭克华 | 2018 | 计算机工程与应用2018,54,6: | 1 |