基本信息来源于合作网站,原文需代理用户跳转至来源网站获取       
摘要:
欠采样和过采样是解决非平衡数据分类问题的常用方法.针对目前解决数据非平衡分布主要采用单一的采样方法可能会导致过拟合或重要样本丢失的问题,提出了一种基于量子进化算法的混合采样方法MSQEA(Mixed-Sampling method based on Quantum Evolutionary Algorithm).该方法对多数类和少数类样本分别进行编码,组成量子进化算法中的个体种群,然后通过迭代得到合适的候选采样子集.针对得到的候选采样子集,首先使用欠采样移除多数类样本,避免了后续的过采样方法合成过多冗余的少数类样本的问题,然后采用过采样方法对少数类样本进行过采样,得到一个平衡数据集.同时,为了有效地评价量子个体的适应度,使用聚类算法对原始数据集进行聚类,构建一个有效的验证集来评价个体.为了验证MSQEA算法的性能,在KEEL网站下载的非平衡数据集上,采用SMO,J48和NB等作为分类算法测试不同采样算法处理后的分类性能.实验结果表明,MSQEA算法相比当前较为优秀的采样算法在多种分类器上具有更好的分类性能.
推荐文章
基于混合采样的非平衡数据集分类研究
混合采样
错分样本
非平衡数据集
AdaBoost算法
支持向量机算法
一种新型的多目标优化混合量子进化算法
多目标优化
量子进化算法
量子门
旋转角
交叉
基于混合采样的非平衡数据分类算法
非平衡
支持向量机(SVM)
少数类样本过采样技术(SMOTE)
分类超平面
混合采样
采用灰色码观测的量子进化算法
量子进化算法
Hamming悬崖
灰色码
内容分析
关键词云
关键词热度
相关文献总数  
(/次)
(/年)
文献信息
篇名 基于量子进化算法的非平衡数据混合采样算法
来源期刊 计算机科学 学科 工学
关键词 非平衡数据 量子进化算法 混合采样 分类
年,卷(期) 2020,(11) 所属期刊栏目 数据库&大数据&数据科学
研究方向 页码范围 88-94
页数 7页 分类号 TP391
字数 语种 中文
DOI 10.11896/jsjkx.191000102
五维指标
作者信息
序号 姓名 单位 发文数 被引次数 H指数 G指数
1 杨浩 16 91 5.0 9.0
2 陈红梅 26 66 6.0 7.0
传播情况
(/次)
(/年)
引文网络
引文网络
二级参考文献  (32)
共引文献  (16)
参考文献  (17)
节点文献
引证文献  (0)
同被引文献  (0)
二级引证文献  (0)
1976(1)
  • 参考文献(0)
  • 二级参考文献(1)
1986(1)
  • 参考文献(0)
  • 二级参考文献(1)
1991(1)
  • 参考文献(1)
  • 二级参考文献(0)
1997(1)
  • 参考文献(0)
  • 二级参考文献(1)
2000(1)
  • 参考文献(1)
  • 二级参考文献(0)
2002(4)
  • 参考文献(2)
  • 二级参考文献(2)
2003(1)
  • 参考文献(1)
  • 二级参考文献(0)
2007(1)
  • 参考文献(0)
  • 二级参考文献(1)
2008(2)
  • 参考文献(1)
  • 二级参考文献(1)
2009(5)
  • 参考文献(1)
  • 二级参考文献(4)
2011(2)
  • 参考文献(1)
  • 二级参考文献(1)
2012(3)
  • 参考文献(1)
  • 二级参考文献(2)
2013(2)
  • 参考文献(1)
  • 二级参考文献(1)
2014(5)
  • 参考文献(1)
  • 二级参考文献(4)
2015(3)
  • 参考文献(0)
  • 二级参考文献(3)
2016(7)
  • 参考文献(0)
  • 二级参考文献(7)
2017(4)
  • 参考文献(2)
  • 二级参考文献(2)
2018(3)
  • 参考文献(2)
  • 二级参考文献(1)
2019(2)
  • 参考文献(2)
  • 二级参考文献(0)
2020(0)
  • 参考文献(0)
  • 二级参考文献(0)
  • 引证文献(0)
  • 二级引证文献(0)
研究主题发展历程
节点文献
非平衡数据
量子进化算法
混合采样
分类
研究起点
研究来源
研究分支
研究去脉
引文网络交叉学科
相关学者/机构
期刊影响力
计算机科学
月刊
1002-137X
50-1075/TP
大16开
重庆市渝北区洪湖西路18号
78-68
1974
chi
出版文献量(篇)
18527
总下载数(次)
68
论文1v1指导