数学建模社区-数学中国

标题: 一种基于高斯过采样的集成学习算法 [打印本页]

作者: 杨利霞    时间: 2020-11-20 15:28
标题: 一种基于高斯过采样的集成学习算法
一种基于高斯过采样的集成学习算法

& |! h* S9 u' O' p6 A
+ K7 w' I5 P8 N) @/ C  J
* L. e  }& E* b! e5 V  k& n, m8 |
在数据挖掘研究领域, 分类任务广泛存在着数据分布不均衡问题, 例如制造状态检测, 医疗
" t9 h. ~% u  L" a诊断, 金融服务, 等等. SMOTE 是处理不均衡数据分类问题的常用技术, 与 Boosting 算法相结合可
; w/ h( F/ Y) n( h2 N# o- D' S进一步提升分类系统性能, 但是这种集成学习容易导致基分类器多样性缺失. 基于此, 本文提出了3 N$ i% f) f  X8 N$ v* {7 |* {
一种基于高斯过程 SMOTE过采样的 Boosting集成学习算法, 即(Gaussian-based SMOTE in Boosting,
- d) \9 `/ G) ^, e, a, FGSMOTEBoost). 该算法在 Boosting 集成框架下构建不均衡学习模型, 为了提高分类系统的鲁棒性,6 }4 C4 ^0 z9 y8 |/ Z7 c* z
采用基于高斯过程 SMOTE 过采样技术来增加基分类器训练样本的多样性, 从而提高基分类器之- n& `7 q; N6 o$ Y* N) m7 d+ t
间的差异. 为了验证算法的有效性, 以常用的处理不均衡分类问题的算法作为对比方法, 采用 KEEL
" g6 o" s# ?: w/ B! G3 X1 y5 ?数据库里的 20 个标准数据集对算法进行测试, 以 G-mean, F-measure 以及 AUC 作为算法的评价指
8 y1 V+ q6 m' R: L/ _标, 利用统计检验手段对实验结果进行分析. 实验结果表明, 相对于其他算法, 本文提出的
6 N, S: }; |' A% a  ~6 D) D8 _" SGSMOTEBoost 具有显著的优势.
+ m! \: P; m1 i, p2 F* q& i5 c
3 G( \. ?0 P. x+ \# T4 z) M3 q
0 ^& [7 i- N* G3 p: H" r
, r* [7 ~# C2 n6 C. @! I- [
# I; N, E7 n1 u* v% N

一种基于高斯过采样的集成学习算法.pdf

559.04 KB, 下载次数: 0, 下载积分: 体力 -2 点






欢迎光临 数学建模社区-数学中国 (http://www.madio.net/) Powered by Discuz! X2.5