返回
An improved TextRank algorithm based on complex network features
DOI:10.1142/S0129183125420112.png)
摘要
En 中文
关键词提取在自然语言处理领域具有广泛的应用。目前有许多方法用于关键词提取,但关键词提取的准确性仍需提升。本文提出了一种改进的中文关键词提取算法C-TextRank,该算法基于复杂网络进一步提高了关键词提取的准确性。基于TextRank,C-TextRank通过融合节点的位置、度数和聚类系数来计算最终权重。最终权重值通过结合位置系数获得,并应用于节点排序,最终提取Top-K节点作为关键词。本研究使用中文新闻网站《南方周末》作为语料库,并选取四种关键词提取算法进行比较。实验表明,当节点度数和聚类系数的权重分别设置为0.8和0.2时,C-TextRank表现最佳。在关键词提取的精确度、召回率和F值等指标上,本算法优于其他四种对比算法。与TextRank相比,精确度、召回率和F值的平均值分别提升了6.3%、8.6%和6.5%。
Keyword:
Complex network
keyword extraction
TextRank
word co-occurrence network
期刊
I
IF:
1.6
论文数:
143
被引数:
1
机构
引用论文
Isotropic Dirac fermion and anomalous oscillator strength of the zeroth Landau level transition in LaAlSi各向同性狄拉克费米子及零阶朗道能级跃迁的反常振荡强度在LaAlSi中
A Novel Method to Identify Key Nodes in Complex Networks Based on Degree and Neighborhood Information基于度和邻域信息识别复杂网络中关键节点的一种新方法
Multi-supervisor association network cold start recommendation based on meta-learning基于元学习的多导师关联网络冷启动推荐

