国内刊号:51-1307/TP
国际刊号:1001-9081
发布日期:
作者:刘晶鑫, 黄雯静, 徐亮胜, 黄冲, 吴建生
单位:1.南昌大学 数学与计算机学院,南昌 330031;2.北方联创通信有限公司,南昌 330096;3.南昌大学 信息化办公室,南昌 330031
关键词:无监督特征选择,字典学习,自适应图学习,样本关联保持,相似度矩阵
基金:国家自然科学基金资助项目(62066027);江西省自然科学基金资助项目(20212BAB212011);江西省研究生创新基金资助项目(YC2022?s160)
针对大多数基于字典学习的无监督特征选择模型没有充分挖掘数据间的本质关联,进而降低了特征重要性判断的准确性这一问题,提出一种字典学习与样本关联保持结合的无监督特征选择模型(DLSCP)。首先,从数据中学习字典基以完成对原始数据的编码,并在字典空间中获得能够反映数据分布的隐表示;其次,进一步在字典空间中自适应地学习数据间的本质关联,以消除冗余特征和噪声特征的影响,从而获得准确的数据间的局部几何结构;最后,利用数据间的本质关联评估数据特征的关联性和重要性。在TOX数据集上的实验结果表明,当选择50个特征时,DLSCP在归一化互信息(NMI)和聚类准确度(Acc)这2个评价指标上,相较于非负谱分析模型NDFS(Nonnegative Discriminative Feature Selection)分别提升了13.33和7.95个百分点,相较于隐空间嵌入无监督特征选择模型LSEUFS(Latent Space Embedding for Unsupervised Feature Selection via joint dictionary learning)分别提升了15.74和7.31个百分点,验证了DLSCP的有效性。
来源:2024年第12期
《计算机应用》期刊编辑部