基本信息来源于合作网站,原文需代理用户跳转至来源网站获取       
摘要:
[目的]为了对烟叶产地进行相似性度量和分类,并克服高维空间下距离度量失效的问题.[方法]文章通过方差权重法、主成分分析法及局部线性嵌入法三种方法对烟叶属性指标进行降维和筛选,使用经过特征降维后的数据相似性进行计算及K-means聚类分析.[结果]通过分析不同方法所得输入指标的聚类的轮廓系数发现,方差权重法所筛选出的总植物碱、还原糖、钾、含梗率四个指标的聚类效果较两种降维算法所得的指标的聚类效果更好,对烟叶质量评估有较强的参考价值.K-means聚类算法将烟叶产区分为四类并且得到各类中属性特点,通过相似性算法所得到的结果在以麒麟区、宣威县、罗平县为代表的县区的相似性产地上与业内现有研究相互验证.[结论]文章基于机器学习算法,通过数据挖掘得到烟叶感官数据中的特征性指标与产地之间的相似性特点,为烟叶工业生产提供了具有一定参考价值的指标与结论,也为机器学习在烟草工业中的应用提供了算法基础.
推荐文章
基于相似性度量的高维聚类算法的研究
高维数据
聚类分析
相似性度量
基于超边相似性的超图聚类改进算法
聚类
超图
超边距离阈值
基于最大偏差相似性准则的交通流聚类算法
交通流曲线
聚类算法
曲线形态
相似性
内容分析
关键词云
关键词热度
相关文献总数  
(/次)
(/年)
文献信息
篇名 数据降维及聚类算法在烟叶相似性分析中的应用
来源期刊 数据与计算发展前沿 学科
关键词 数据挖掘 相似性 聚类 烟叶
年,卷(期) 2021,(1) 所属期刊栏目 技术与应用|Technology and Applicaton
研究方向 页码范围 112-121
页数 10页 分类号
字数 语种 中文
DOI 10.11871/jfdc.issn.2096-742X.2021.01.009
五维指标
传播情况
(/次)
(/年)
引文网络
引文网络
二级参考文献  (86)
共引文献  (67)
参考文献  (10)
节点文献
引证文献  (0)
同被引文献  (0)
二级引证文献  (0)
1989(1)
  • 参考文献(0)
  • 二级参考文献(1)
1993(2)
  • 参考文献(0)
  • 二级参考文献(2)
1997(2)
  • 参考文献(0)
  • 二级参考文献(2)
1998(1)
  • 参考文献(0)
  • 二级参考文献(1)
2000(4)
  • 参考文献(0)
  • 二级参考文献(4)
2001(1)
  • 参考文献(0)
  • 二级参考文献(1)
2002(2)
  • 参考文献(0)
  • 二级参考文献(2)
2003(1)
  • 参考文献(0)
  • 二级参考文献(1)
2004(2)
  • 参考文献(0)
  • 二级参考文献(2)
2005(2)
  • 参考文献(0)
  • 二级参考文献(2)
2006(8)
  • 参考文献(0)
  • 二级参考文献(8)
2007(3)
  • 参考文献(0)
  • 二级参考文献(3)
2008(2)
  • 参考文献(0)
  • 二级参考文献(2)
2009(7)
  • 参考文献(1)
  • 二级参考文献(6)
2010(6)
  • 参考文献(1)
  • 二级参考文献(5)
2011(8)
  • 参考文献(0)
  • 二级参考文献(8)
2012(6)
  • 参考文献(2)
  • 二级参考文献(4)
2013(6)
  • 参考文献(1)
  • 二级参考文献(5)
2014(4)
  • 参考文献(1)
  • 二级参考文献(3)
2015(2)
  • 参考文献(0)
  • 二级参考文献(2)
2016(4)
  • 参考文献(0)
  • 二级参考文献(4)
2017(7)
  • 参考文献(0)
  • 二级参考文献(7)
2018(5)
  • 参考文献(0)
  • 二级参考文献(5)
2019(9)
  • 参考文献(3)
  • 二级参考文献(6)
2020(1)
  • 参考文献(1)
  • 二级参考文献(0)
2021(0)
  • 参考文献(0)
  • 二级参考文献(0)
  • 引证文献(0)
  • 二级引证文献(0)
研究主题发展历程
节点文献
数据挖掘
相似性
聚类
烟叶
研究起点
研究来源
研究分支
研究去脉
引文网络交叉学科
相关学者/机构
期刊影响力
数据与计算发展前沿
双月刊
2096-742X
10-1649/TP
大16开
北京市海淀区中关村南四街4号
2-493
2008
chi
出版文献量(篇)
135
总下载数(次)
3
论文1v1指导