欢迎光临中图网 请 | 注册
> >
文本挖掘中若干关键问题研究

文本挖掘中若干关键问题研究

作者:陆旭
出版社:中国科学技术大学出版社出版时间:2008-12-01
所属丛书: 博士论丛
开本: 16开 页数: 117
中 图 价:¥6.8(3.4折) 定价  ¥20.0 登录后可看到会员价
暂时缺货 收藏
运费6元,满39元免运费
?新疆、西藏除外
温馨提示:5折以下图书主要为出版社尾货,大部分为全新(有塑封/无塑封),个别图书品相8-9成新、切口
有划线标记、光盘等附件不全详细品相说明>>
本类五星书更多>

文本挖掘中若干关键问题研究 版权信息

  • ISBN:9787312022807
  • 条形码:9787312022807 ; 978-7-312-02280-7
  • 装帧:暂无
  • 册数:暂无
  • 重量:暂无
  • 所属分类:>

文本挖掘中若干关键问题研究 本书特色

自动文本分类是将自然文本文件根据内容自动分为预先定义的一个或几个类别的过程,基于统计学习、机器学习的文本分类技术已经成为主流技术,本书对基于统计学习的文本分类及其相关技术进行了研究,为解决文本分类的稀疏性和高维性问题,基于偏*小二乘理论,提出一种新的维数约简算法,从提高文本分类性能和准确性出发,运用偏*小二乘的*新理论成果,提出了一种能较好提取潜在语义的新文本分类模型,对于数量庞大的文档类别,传统的平坦文本分类的性能受到很大的制约,层次文本分类是一种有效的解决方法,由此提出了一种新的层次文本分类模型。

文本挖掘中若干关键问题研究 内容简介

本书介绍了文本分类和偏*小二乘回归,提出了基于变量投影重要性指标的文本分类特征选择方法,论述了偏*小二乘logistic文本分类模型,阐述了chtc层次文本分类模型的研究工作,本书可供相关领域科研工作者、大学高年级学生和研究生阅读。

文本挖掘中若干关键问题研究 目录

前言
第1章 导论
1.1 研究背景
1.2 文本分类综述
1.3 本书的内容结构
1.4 本书的创新工作
第2章 文本分类概述
2.1 文本分类的数学定义
2.2 文本分类任务的特点
2.3 文本分类系统的组成
2.4 文档预处理
2.5 文档的表示
2.6 常用文本分类模型
2.7 文本分类器学习、测试和评价
第3章 偏*小二乘回归方法的基本理论
3.1 偏*小二乘回归的发展历史
3.2 偏*小二乘回归的基本原理
3.3 偏*小二乘回归的基本思想
3.4 数学原理
3.5 偏*小二乘回归的理论算法
3.6 成分数的确定
第4章 基于变量投影重要性指标的特征选择方法研究
4.1 维数约简技术
4.2 符号约定
4.3 常用的特征选择方法
4.4 常用的特征抽取方法
4.5 基于变量投影重要性指标的特征选择方法
4.6 实验结果和分析
第5章 偏*小二乘logistic文本分类模型研究
5.1 logistic回归模型
5.2 偏*小二乘logistic回归模型
5.3 偏*小二乘logistic文本分类模型
5.4 实验结果和分析
第6章 ghtc层次文本分类模型研究
6.1 层次分类概述
6.2 层次特征选择
6.3 ghtc层次文本分类模型
6.4 实验结果和分析
第7章 总结与展望
7.1 总结
7.2 研究展望
附录1 reuters-21578前10个常见类和前10个稀有类的前20个特征vip值
附录2 复旦文本分类语料库部分类别的前20个特征vip值
附录3 ohsumed语料库层次结构
附录4 20 newsgroups语料库各节点各特征维数的微平均f1值和宏平均f1值变化情况
参考文献
后记
展开全部

文本挖掘中若干关键问题研究 节选

《文本挖掘中若干关键问题研究》介绍了文本分类和偏*小二乘回归,提出了基于变量投影重要性指标的文本分类特征选择方法,论述了偏*小二乘Logistic文本分类模型,阐述了CHTC层次文本分类模型的研究工作,《文本挖掘中若干关键问题研究》可供相关领域科研工作者、大学高年级学生和研究生阅读。

商品评论(0条)
暂无评论……
书友推荐
本类畅销
编辑推荐
返回顶部
中图网
在线客服