基于Hubness与类加权的k最近邻分类算法

被引：13

作者：

李金孟

林亚平

祝团飞

机构：

[1] 湖南大学信息科学与工程学院

来源：

计算机工程 | 2018年 / 44卷 / 04期

关键词：

Hubness现象; 高维不平衡数据; 维数灾难; 数据分类; k发生; k最近邻分类;

D O I：

暂无

中图分类号：

TP181 [自动推理、机器学习];

学科分类号：

140502 [人工智能];

摘要：

针对高维不平衡数据中维数灾难和类不平衡分布问题,提出一种改进k最近邻(kNN)分类算法HWNN。将样本的k发生分布作为其在预测时对各个类的支持度,以此减少高维数据中hubs对kNN分类带来的潜在负面影响。通过类加权的方式增加少数类在所有样本k发生中的分布比例,以提升对少数类样本的预测精度。在16个不平衡UCI数据集上的实验结果表明,该算法在高维不平衡数据中的分类结果优于典型kNN方法,且在普通维度的不平衡数据中优势同样明显。

引用

页码：248 / 252+261 +261

页数：6

共 10 条

[1]

基于Hub的高维数据初始聚类中心的选择策略 [J].