
会员
类别不平衡学习:理论与算法
更新时间:2020-11-28 17:49:05 最新章节:参考文献
书籍简介
类别不平衡学习是机器学习与数据挖掘领域的重要分支之一,其在很多应用领域中均发挥着重要作用。本书首先系统地介绍了与类别不平衡学习相关的一些基础概念及理论(第1、2章),进而在上述理论的基础上,讨论了一些主流的类别不平衡学习技术及对应算法,具体包括样本采样技术(第3章)、代价敏感学习技术(第4章)、决策输出补偿技术(第5章)、集成学习技术(第6章)、主动学习技术(第7章)及一类分类技术(第8章)等。此外,也探讨了样本不平衡分布的危害预评估技术(第9章)。最后,对该领域未来的发展方向及应用前景做出了评述与展望(第10章)。本书可作为高等院校与研究院所计算机、自动化及相关专业研究生的课外阅读书籍,也可供对机器学习及数据挖掘感兴趣的研究人员和工程技术人员阅读参考。
品牌:清华大学
上架时间:2017-06-01 00:00:00
出版社:清华大学出版社
本书数字版权由清华大学提供,并由其授权上海阅文信息技术有限公司制作发行
最新章节
于化龙
同类热门书
最新上架
- 会员本书旨在向广大有志于投身芯片设计行业的人士及正在从事芯片设计的工程师普及芯片设计知识和工作方法,使其更加了解芯片行业的分工与动向。本书共分9个章节,从多角度透视芯片设计,特别是数字芯片设计的流程、工具、设计方法、仿真方法等环节。凭借作者多年业内经验,针对IC新人关心的诸多问题,为其提供了提升个人能力,选择职业方向的具体指导。本书第1章是对IC设计行业的整体概述,并解答了IC新人普遍关心的若干问题。计算机29.9万字
- 会员这是一本站在一线开发人员的视角,从SQL的本质出发,采用理论与实践相结合、案例与分析相结合、作者经验与一线需求相结合的方式,深度解读大数据SQL优化核心技术和解决方案的工具书。本书主要面向大数据初中级技术人员,期望帮大家深度理解大数据SQL优化原理,掌握SQL优化的落地实践方法,从而真正“玩转”大数据SQL优化技术,根据实际问题和需求设计出有针对性的提升SQL性能的解决方案。计算机14万字
- 会员这是一套数据指标体系全流程构建(从规划、框架设计、数据采集加工到应用)方法论与实践指南。它不仅深入浅出地分享了通用的数据指标体系构建策略,还通过多个行业实例展示了具体操作方法。书中从数据采集入手,借助BI工具Superset实践构建过程。本着“一切技术都是为业务服务的”这一宗旨,本书除了包含数据指标体系构建相关内容外,还结合统计学原理及Excel、Python等工具,深入剖析数据指标波动对业务的影计算机12.7万字
- 会员《MySQL从入门到精通(第3版)》从初学者角度出发,通过通俗易懂的语言和丰富多彩的实例,详细介绍了MySQL开发需要掌握的各方面技术。全书共分为4篇22章,包括数据库基础,初识MySQL,使用MySQL图形化管理工具,数据库操作,存储引擎及数据类型,数据表操作,MySQL基础,表数据的增、删、改操作,数据查询,常用函数,索引,视图,数据完整性约束,存储过程与存储函数,触发器,事务,事件,备份与恢计算机14万字
- 会员《SQLServer从入门到精通(第5版)》从初学者角度出发,通过通俗易懂的语言、丰富多彩的实例,详细介绍了SQLServer开发所必需的各方面技术。全书分为4篇共19章,内容包括数据库基础、SQLServer数据库环境搭建、创建与管理数据库、操作数据表、SQL基础、SQL函数的使用、SQL数据查询基础、SQL数据高级查询、视图的使用、存储过程、触发器、游标的使用、索引与数据完整性、SQL中计算机14.1万字
- 会员本书以Python作为开发语言,系统介绍PySpark开发环境搭建流程及基于PySpark进行大数据分析的相关知识。本书条理清晰、重点突出,理论叙述循序渐进、由浅入深。本书共7章,第1?5章包括PySpark大数据分析概述、PySpark安装配置、基于PySpark的DataFrame操作、基于PySpark的流式数据处理、基于PySpark的机器学习库,内容介绍注重理论与实践相结合,通过典型示例计算机10.4万字
- 会员高质量的数据关乎企业运营、合规、决策和业绩的关键,哈佛商业评论的一项研究发现,企业中只有3%的数据符合质量标准,绝大多数公司都在寻求切实可行的指导来提高数据质量。本书作者基于多年在数据、数据分析和人工智能方面的实践经验,阐述了4步构建高质量数据体系。他提出了高质量数据的四阶段DARS方法(定义、评估、实现、持续)和10个数据质量最佳实践案例,以此来提高业务中的数据质量水平,为业务提供数据价值,保证计算机11.7万字
- 会员本书是《数据库原理——GaussDB技术及应用》一书配套的辅助教材。全书共分3部分:第一部分为实验指导,共有13个综合实验,每一个实验都是根据教学目标而设计,详细讲述了每一个实验的实验目的、实验任务及实验步骤,从而培养学生掌握关系数据库管理软件技术与应用的技能;第二部分为习题集,是根据主教材各章节内容编写的习题及习题答案,内容广泛,有填空、选择、简答、设计及实验题等多种形式,利求通过对这些习题的训计算机6.9万字
同类书籍最近更新
- 会员本书是热销书《SQL基础教程》的作者MICK为志在向中级进阶的数据库工程师编写的一本SQL技能提升指南。全书可分为两大部分。第一部分介绍了SQL语言不同寻常的使用技巧,带领读者重新认识CASE表达式、窗口函数、自连接、EXISTS谓词、HAVING子句、外连接、行间比较、集合运算、数列处理等SQL常用技术,发掘它们的新用法。这部分不仅穿插讲解了这些技巧背后的逻辑和相关知识,而且辅以丰富的示例程序,数据库15万字
- 会员ThisisastepbysteptutorialthatdealswithMicrosoftServer2012reportingtools:SSRSandPowerView.IfyouareaBIdeveloper,consultant,orarchitectwhowishestolearnhowtouseSSRSandPowe数据库3万字
- 会员本书以VisualFoxpro9.0为例,详细介绍了VisualFoxpro9.0的特点、功能以及如何使用VisualFoxpro9.0进行程序设计与项目设计,并按照使用数据库的逻辑顺序,从数据库的交互操作、数据库程序设计和数据库应用系统开发3个方面组织教材内容,精心设计丰富恰当的实例,引导读者循序渐进的掌握数据库的基本理论和数据库应用系统开发的方法。数据库14.3万字
- 会员本书以大学图书馆的OPAC日志数据为例,主要借助日志分析和内容分析方法,对日志记录进行了梳理、编码,并从信息需求的特点、用户的检索策略(提问调整方式与模式)、用户遭遇检索失败的原因、应对及应对效果等角度进行了分析和讨论;在研究发现的基础上,从OPAC系统的完善、图书馆资源的建设、图书馆用户信息素养的提升等方面提出了建议和对策,改善高校图书馆的馆藏资源可获得性,改进高校图书馆系统的服务效能,提高用户数据库13.3万字
- 会员《检索匹配:深度学习在搜索、广告、推荐系统中的应用》主要介绍了深度学习在互联网核心的三大类业务(搜索、广告、推荐系统)检索系统中的应用。书中详细讲述了检索匹配的理论、演进历史,以及在业务中落地一个基于深度学习算法模型的全流程技能,包括业务问题建模、样本准备、特征抽取、模型训练和预测等,并提供了相应的代码。《检索匹配:深度学习在搜索、广告、推荐系统中的应用》共11章,分为四大部分。第1部分(第1~2数据库8.5万字