现代图书情报技术杂志文献阅读_词向量聚类加权TextRank的关键词抽取

词向量聚类加权TextRank的关键词抽取

夏天中国人民大学数据工程与知识工程教育部重点实验室; 北京100872; 中国人民大学信息资源管理学院; 北京100872

摘要：【目的】将维基百科蕴涵的世界知识以词向量方式融入TextRank模型，改进单文档关键词抽取效果。【方法】利用Word2Vec模型基于维基百科中文数据，生成词向量模型，对TextRank词图节点的词向量进行聚类以调整簇内节点的投票重要性，结合节点的覆盖和位置因素，计算节点之间的随机跳转概率，生成转移矩阵，最终通过迭代计算获得节点的重要性得分，选取前TopN个词语生成关键词。【结果】当TopN≤7时，词向量聚类加权方法均优于对比方法；TopN=3时，F值取得最大值，比先前最优结果增量提升了3．374％；TopN〉7时，结果与位置加权法相似。【局限】聚类分析使得计算开销变高。【结论】词向量聚类加权能够改善关键词抽取效果。

注: 保护知识产权,如需阅读全文请联系现代图书情报技术杂志社

词向量聚类加权TextRank的关键词抽取

相关推荐

服务特色

快速见刊

收费透明

专业保障

隐私保护

资金安全

关于我们

咨询服务

付款方式

联系我们

地址