论文部分内容阅读
科研热点对科学研究具有指导意义, 目前的科研热点发现主要依赖文本聚类技术, 针对文本表示存在的特征语义表达能力不强、 无法揭示词语之间潜在联系的问题, 提出了一种基于Paragraph Vector模型的科研热点发现方法.该方法对文本集使用Paragraph Vector模型构建文本语义向量表示, 并根据语义向量的相似度计算结果进行聚类分析得到主题集, 最后基于主题文本引用特征选择前N个主题作为科研热点.实验结果表明, 科研热点发现的聚类评价ARI值为0.452、 H值为0.532、 C值为0.538、