基本信息来源于合作网站,原文需代理用户跳转至来源网站获取       
摘要:
提出Dirichlet混合多项式(DCM)流形,并利用DCM流形可与正半球流形建立同胚和等距关系的性质,通过拉回映射将正半球流形的测地距离映射为DCM流形的测地距离,从而在DCM流形上建立距离度量,构建统计流形上的Dirichlet混合多项式扩散核和Dirichlet混合多项式倒排文档频率(DCMIDF)扩散核.利用WebKB Top 4和20 Newsgroups语料库上进行实验,DCM流形能比欧氏空间更能准确地描述文本.与多项式核支持向量机算法、,负测地距离核支持向量机算法相比,实验结果显示文中基于DCM扩散核和DCMIDF扩散核的支持向量机算法可取得良好的文本分类效果.
推荐文章
文本分类中一种基于核的最大散度差特征抽取方法
文本分类
特征抽取
特征降维
散度差准则
核变换
文本分类中的特征选择方法
文本分类
特征选择
评估函数
文本分类技术研究
文本分类
文本模型
数据挖掘
文本分类技术研究
文本挖掘
文本分类
特征表示
特征抽取
模型评估
内容分析
关键词云
关键词热度
相关文献总数  
(/次)
(/年)
文献信息
篇名 统计流形扩散核的文本分类方法
来源期刊 模式识别与人工智能 学科 工学
关键词 统计流形 扩散核 Dirichlet分布 文本分类
年,卷(期) 2012,(2) 所属期刊栏目 研究与应用
研究方向 页码范围 339-345
页数 分类号 TP391
字数 5753字 语种 中文
DOI 10.3969/j.issn.1003-6059.2012.02.023
五维指标
作者信息
序号 姓名 单位 发文数 被引次数 H指数 G指数
1 刘玉树 北京理工大学计算机学院 150 2634 25.0 46.0
2 李侃 北京理工大学计算机学院 21 205 5.0 14.0
3 周世斌 中国矿业大学计算机科学与技术学院 4 5 1.0 2.0
传播情况
(/次)
(/年)
引文网络
引文网络
二级参考文献  (0)
共引文献  (0)
参考文献  (3)
节点文献
引证文献  (4)
同被引文献  (8)
二级引证文献  (11)
2005(1)
  • 参考文献(1)
  • 二级参考文献(0)
2008(1)
  • 参考文献(1)
  • 二级参考文献(0)
2009(1)
  • 参考文献(1)
  • 二级参考文献(0)
2012(0)
  • 参考文献(0)
  • 二级参考文献(0)
  • 引证文献(0)
  • 二级引证文献(0)
2014(2)
  • 引证文献(2)
  • 二级引证文献(0)
2015(1)
  • 引证文献(1)
  • 二级引证文献(0)
2016(2)
  • 引证文献(0)
  • 二级引证文献(2)
2017(3)
  • 引证文献(1)
  • 二级引证文献(2)
2018(1)
  • 引证文献(0)
  • 二级引证文献(1)
2019(4)
  • 引证文献(0)
  • 二级引证文献(4)
2020(2)
  • 引证文献(0)
  • 二级引证文献(2)
研究主题发展历程
节点文献
统计流形
扩散核
Dirichlet分布
文本分类
研究起点
研究来源
研究分支
研究去脉
引文网络交叉学科
相关学者/机构
期刊影响力
模式识别与人工智能
月刊
1003-6059
34-1089/TP
16开
中国科学院合肥智能机械研究所安徽合肥董铺岛合肥1130信箱
26-69
1989
chi
出版文献量(篇)
2928
总下载数(次)
8
总被引数(次)
30919
论文1v1指导