一种融合采样技术和RE算法的微博转发行为预测方法
大小:0.96 MB 人气: 2018-01-07 需要积分:2
标签:采样技术(6329)
针对微博转发预测方法研究中的数据集不平衡问题,提出了一种融合过采样技术和随机森林(RF)算法的微博转发行为预测方法。首先,定义了个体信息、社交关系和微博主题3类与微博转发行为相关的特征,并基于信息增益算法实现了关键特征选取;其次,综合微博特征数据的特点来改进少数类样本合成过采样技术( SMOTE),对原始数据集进行非参数概率分布估计,并根据近似概率分布对数据集进行过采样处理,从而使正反例数据量达到平衡;最后,利用随机森林算法,依据微博转发关键特征进行分类器训练,并利用袋外(OOB)数据误差估计来分析和设置随机森林算法的相关参数。通过与基于决策树(DT)、支持向量机(SVM)、朴素贝叶斯(NB)和随机森林等算法的微博转发预测方法进行对比,所提方法整体性能优于基准方法中性能最优的SVM方法,召回率提高了8%,F值提高了5%。实验结果表明,所提方法在实际应用中能够有效提高微博转发行为预测的准确率。
非常好我支持^.^
(0) 0%
不好我反对
(0) 0%
下载地址
一种融合采样技术和RE算法的微博转发行为预测方法下载
相关电子资料下载
- 利用高频采样技术进行高速差分阻抗测试方案 778
- 采样技术对信噪比的提升方法 3535
- 什么是工业过程控制 2371
- 单片机片上的ADC如何利用过采样技术 4094
- 对过采样技术的理解与记忆 777
- 受制于汽车芯片短缺,丰田减产40%;Intel推出超采样技术,利好IoT市场…… 1551
- ADC中采样技术的信号链设计挑战 2741
- Switch Pro或将支持NVIDIA的DLSS深度学习超采样技术 1505
- 消息称Switch Pro将支持NVIDIA的DLSS深度学习超采样技术 1673
- 三相交流标准源采用高精度采样技术,具备多种功能 650