应用预测建模

应用预测建模 pdf epub mobi txt 电子书 下载 2026

出版者:机械工业出版社
作者:[美] 马克斯·库恩
出品人:
页数:454
译者:林荟
出版时间:2016-4-25
价格:99.00元
装帧:平装
isbn号码:9787111533429
丛书系列:数据科学与工程技术丛书
图书标签:
  • 机器学习
  • R语言
  • 统计学习
  • 数据科学
  • 统计学
  • 计算机
  • R
  • 人工智能
  • 预测建模
  • 机器学习
  • 数据挖掘
  • 统计建模
  • R语言
  • Python
  • 商业分析
  • 数据科学
  • 时间序列
  • 回归分析
想要找书就要到 小美书屋
立刻按 ctrl+D收藏本页
你会得到大惊喜!!

具体描述

作者简介

目录信息

译者序
前言
第1章 导论
1.1 预测与解释
1.2 预测模型的关键部分
1.3 专业术语
1.4 实例数据集和典型数据场景
1.5 概述
1.6 符号
第一部分 一般策略
第2章 预测建模过程简介
2.1 案例分析:预测燃油效能
2.2 主题
2.3 总结
第3章 数据预处理
3.1 案例分析:高内涵筛选中的细胞分组
3.2 单个预测变量数据变换
3.3 多个预测变量数据变换
3.4 处理缺失值
3.5 移除预测变量
3.6 增加预测变量
3.7 区间化预测变量
3.8 计算
习题
第4章 过度拟合与模型调优
4.1 过度拟合的问题
4.2 模型调优
4.3 数据分割
4.4 重抽样技术
4.5 案例分析:信用评分
4.6 选择调优参数值
4.7 数据划分建议
4.8 不同模型间的选择
4.9 计算
习题
第二部分 回归模型
第5章 衡量回归模型的效果
5.1 模型效果的定量度量
5.2 方差偏差的权衡
5.3 计算
第6章 线性回归及其扩展
6.1 案例分析:定量构效关系建模
6.2 线性回归
6.3 偏最小二乘法
6.4 惩罚模型
6.5 计算
习题
第7章 非线性回归模型
7.1 神经网络
7.2 多元自适应回归样条
7.3 支持向量机
7.4 K近邻
7.5 计算
习题
第8章 回归树与基于规则的模型
8.1 简单回归树
8.2 回归模型树
8.3 基于规则的模型
8.4 装袋树
8.5 随机森林
8.6 助推法
8.7 Cubist
8.8 计算
习题
第9章 溶解度模型总结
第10章 案例研究:混凝土混合物的抗压强度
10.1 模型构建策略
10.2 模型性能
10.3 优化抗压强度
10.4 计算
第三部分 分类模型
第11章 分类模型的效果度量
11.1 类预测
11.2 评估预测类
11.3 评估类概率
11.4 计算
第12章 判别分析和其他线性分类模型
12.1 案例分析:预测是否成功申请经费
12.2 逻辑回归
12.3 线性判别分析
12.4 偏最小二乘判别分析
12.5 惩罚模型
12.6 最近收缩质心
12.7 计算
习题
第13章 非线性分类模型
13.1 非线性判别分析
13.2 神经网络
13.3 灵活判别分析
13.4 支持向量机
13.5 K近邻
13.6 朴素贝叶斯
13.7 计算
习题
第14章 分类树与基于规则的模型
14.1 基本的分类树
14.2 基于规则的模型
14.3 装袋决策树
14.4 随机森林
14.5 助推法
14.6 C5.0
14.7 比较两种分类预测变量编码方式
14.8 计算
习题
第15章 经费申请模型的总结
第16章 对严重类失衡的补救方法
16.1 案例分析: 预测房车保险所有权
16.2 类失衡的影响
16.3 模型调优
16.4 选择截点
16.5 调整先验概率
16.6 不等案例权重
16.7 抽样方法
16.8 成本敏感度训练
16.9 计算
习题
第17章 案例研究:作业调度
17.1 数据切分和模型策略
17.2 结果
17.3 计算
第18章 衡量预测变量重要性
18.1 数值结果变量
18.2 分类结果变量
18.3 其他方法
18.4 计算
习题
第19章 特征选择介绍
19.1 使用无信息预测变量的结果
19.2 减少预测变量个数的方法
19.3 绕封法
19.4 过滤法
19.5 选择偏差
19.6 案例分析:预测认知损伤
19.7 计算
习题
第20章 影响模型表现的因素
20.1 第Ⅲ类错误
20.2 结果变量的测量误差
20.3 预测变量的测量误差
20.4 连续变量离散化
20.5 模型预测何时是可信的
20.6 大样本的影响
20.7 计算
习题
附录
附录A 各种模型的总结
附录B R语言介绍
附录C 值得关注的网站
参考文献
· · · · · · (收起)

读后感

评分

I've read several books in machine learning. • Pattern recognition and machine learning • Introduction of statistical learning • Applied predictive models The first one is a comprehensive book to include all the theories and mathematical formu...

评分

I've read several books in machine learning. • Pattern recognition and machine learning • Introduction of statistical learning • Applied predictive models The first one is a comprehensive book to include all the theories and mathematical formu...

评分

I've read several books in machine learning. • Pattern recognition and machine learning • Introduction of statistical learning • Applied predictive models The first one is a comprehensive book to include all the theories and mathematical formu...

评分

I've read several books in machine learning. • Pattern recognition and machine learning • Introduction of statistical learning • Applied predictive models The first one is a comprehensive book to include all the theories and mathematical formu...

评分

I've read several books in machine learning. • Pattern recognition and machine learning • Introduction of statistical learning • Applied predictive models The first one is a comprehensive book to include all the theories and mathematical formu...

用户评价

评分

这本书的行文风格,我必须说,是一种非常独特且令人耳目一新的存在。作者似乎很擅长用类比和生活化的例子来阐释那些听起来高高在上的数学概念。比如,在解释“过拟合”时,他没有直接抛出误差函数的复杂图解,而是用了一个学徒努力模仿名师作品却失去了自我风格的例子来打比方,瞬间就让这个抽象的概念变得形象起来,我甚至忍不住在心里笑出了声。这种叙事方式极大地降低了初学者的门槛,让那些对统计学有抵触情绪的人也能轻松地跟上节奏。更赞的是,作者的笔触非常冷静客观,即便在介绍某个算法的优越性时,也会毫不避讳地指出其局限性和适用场景,这种坦诚让人感到非常舒服,也避免了陷入“万能算法”的误区。他不是在推销一个工具,而是在教授一套系统的思维框架。阅读过程中,我感觉自己不是在听一个专家说教,而是在和一位经验丰富的前辈并肩作战,他适时地给予指点,却又鼓励你去亲手实践和犯错。这种亦师亦友的沟通方式,是许多技术书籍所缺乏的。

评分

如果从实用性的角度来审视这本书,我会说它的深度和广度达到了一个令人印象深刻的平衡点。它没有像某些纯粹的软件指南那样,只停留在API调用的层面,而是深入探讨了模型背后的逻辑和假设。举个例子,关于时间序列分析的那几个章节,作者没有仅仅展示如何用某个库来跑出结果,而是花了大量篇幅去讨论数据的平稳性检验的重要性,以及不同季节性分解方法的内在差异和适用性前提,这才是真正能将一个初级分析师提升到资深水平的关键所在。我发现,很多其他书籍会把“特征工程”当作一个单独、附属的部分来处理,但在这本书里,它被有机地融入到了每个模型的讨论之中,作者反复强调“Garbage in, garbage out”的道理,并通过大量的反例说明了糟糕的特征是如何摧毁一个看似完美的模型架构的。这种对基础环节的执着,恰恰体现了作者对数据科学实践的深刻理解,它教会了我如何更负责任地对待我的数据和我的结论。

评分

这本书的封面设计着实吸引人,那种深邃的蓝色调配上简洁的字体,散发出一种专业而又充满神秘感的理工科气息。我是在图书馆的书架上偶然瞥见它的,立刻就被那种低调的质感所吸引。拿到手里,分量适中,纸张的触感也相当不错,不是那种廉价的印刷品,看得出出版方在制作上还是用了心的。我本以为这会是一本晦涩难懂的技术手册,但翻开目录时,却发现它涵盖的领域相当广泛,从基础的数据清洗到复杂的模型验证,结构安排得井井有条。特别是章节之间的过渡,设计得非常流畅,不像有些教科书那样生硬地堆砌知识点。我特别欣赏作者在引言部分对“预测”这一概念的哲学探讨,它不仅仅是技术层面的讨论,更上升到了对未来不确定性的理解,这为接下来的技术讲解奠定了非常好的理论基础。我期待着它能带领我进入一个既严谨又富有洞察力的分析世界,而不是简单地罗列公式和代码片段。整体而言,从装帧到初步的阅读体验,这本书给人一种“有料”且“可信赖”的初印象,是那种让人愿意坐下来,沉下心去啃读的类型。

评分

这本书在逻辑连贯性上的构建,绝对是大师级的。它似乎是按照一个真实项目从概念到落地的完整生命周期来组织内容的。开篇奠定理论基础后,紧接着就是数据预处理的“战场”,然后逐步引入不同复杂度、不同适用场景的模型,最后聚焦于评估、优化和部署的“收尾工作”。最妙的是,作者在介绍每一种新算法时,都会巧妙地回顾前一个章节所学到的知识点,形成一种层层递进的知识网络,而不是孤立的知识点集合。例如,在讨论非参数模型时,他会回头引用早期介绍的偏差-方差权衡理论,将它们联系起来,让读者清晰地看到技术选择背后的权衡艺术。这种结构设计让阅读体验变得非常连贯,我很少需要翻回去查阅前面的内容来理解当前章节的重点,因为所有的铺垫都做得非常到位,知识点之间像被看不见的线索紧密地联系在一起,形成了一个强大的知识结构,这对于构建自己的知识体系非常有帮助。

评分

我特别想赞扬一下这本书在“伦理”和“可解释性”方面所花费的心思。在当前大数据和人工智能日益深入我们生活的背景下,单纯追求高准确率已经不再是唯一的衡量标准。这本书非常前瞻性地在靠后的章节中加入了关于模型透明度的讨论。作者并没有简单地提一句“黑箱模型不好”,而是详细地剖析了LIME和SHAP等可解释性工具的工作原理,并用具体的案例展示了,一个准确率稍低但逻辑可解释的模型,在面对监管或客户质询时,会比一个高准确率但原因不明的模型更有说服力。这种对模型“责任心”的强调,让我意识到,作为应用预测建模的实践者,我们肩负的不仅仅是技术上的成功,更有对社会影响的预见。这使得这本书的价值远远超出了纯粹的技术指南,更像是一本关于“如何做一个负责任的数据科学家”的行动纲领,非常具有时代意义和启发性。

评分

深入浅出容易懂,适合入门。内容只局限在预测模型,因此,从机器学习要掌握的内容来说,内容广度不够。

评分

深入浅出容易懂,适合入门。内容只局限在预测模型,因此,从机器学习要掌握的内容来说,内容广度不够。

评分

从实际出发,很有逻辑!

评分

这是可以让你提高进阶的佳作!

评分

本书的作者是R中最受欢迎的机器学习Package “caret” 的作者。这本书可当做是 “caret" 包的操作指南与技术手册。

本站所有内容均为互联网搜索引擎提供的公开搜索信息,本站不存储任何数据与内容,任何内容与数据均与本站无关,如有需要请联系相关搜索引擎包括但不限于百度google,bing,sogou

© 2026 book.quotespace.org All Rights Reserved. 小美书屋 版权所有