短文本聚类算法
大小:0.78 MB 人气: 2017-11-17 需要积分:0
标签:聚类算法(12092)
针对短文本特征极度稀疏、上下文依赖性强等特点,以自顶向下的策略,提出一种基于核心词项平均划分相似度的短文本聚类算法CTMPS。该方法首先在整个短文本语料库中计算词项之间的概率相关性,以此为基础对短文本中词项进行加权,将权值较大的词项作为最能代表该短文本的核心词项形成核心词项集;以信息论为基础,将核心词项作为划分依据计算平均划分相似度,选择平均划分相似度值最大包含该核心词项的短文本形成一类,用此策略反复迭代直到满足要求。最后,实验结果表明,本文提出的方法显著地提高了短文本聚类的性能。
非常好我支持^.^
(0) 0%
不好我反对
(0) 0%
下载地址
短文本聚类算法下载
相关电子资料下载
- 基于K-means聚类算法的图像分割 1113
- 介绍一种基于最小化平方误差的聚类算法 498
- 如何在 Python 中安装和使用顶级聚类算法 415
- 10种聚类算法和Python代码4 1118
- 10种聚类算法和Python代码3 960
- 10种聚类算法和Python代码2 796
- 10种聚类算法和Python代码1 644
- YOLOv5中的autoanchor.py代码解析 1242
- 视觉新范式!COCs:将图像视为点集 636
- 10种顶流聚类算法Python实现(附完整代码) 989