- 2
- 0
- 约3.65千字
- 约 4页
- 2019-02-14 发布于湖北
- 举报
这一章的内容是模型评估与选择,断断续续看了两周时间,感觉比看模型还费劲。其实这一章的大部分内容我是熟悉的,包括各种模型选择的准则,交叉验证以及bootstrap,这些在实际建模的时候也经常用到,但是关于其原理确实不是很清晰。这一章给出了详尽,但是又不那么理论的阐述。经典确实是经典。闲话不多说了,开始读书笔记。对于同一个问题,比如分类问题或者预测问题,往往会有一系列的模型都可以做。那么这些模型表现的如何,如何从这些模型中选择一个合适的,最好的模型,就成为了一个问题。而这个问题在实际中是非常重要的。我们都知道,模型是建立在训练样本上的,而预测是需要在一个独立的新的样本上进行的。在训练样本上所建立的模型,其在一个新的独立的样本上的表现如何进行评估,是一个非常重要的问题。这一章首先介绍了偏差(bias),方差(variance)以及模型复杂度(model complexity)。我们有一个target variable Y,以及输入向量X,以及通过训练样本得到的对于响应的估计(也就是我们的模型)f?(X)。此外,我们还应该有一个损失函数L(Y,f?(X))。损失函数可以有多种选择,比如平方损失,绝对值损失,这两个主要是针对定量的响应的,对于定性的响应,也有0-1损失,对数似然之类的。一般而言,损失函数中比较常用的就是这些。有了模型以及损失函数之后,首先定义test error(原谅我在这里
您可能关注的文档
最近下载
- 低空经济与智慧水务融合的管网巡检研究.docx VIP
- 羊膜移植治疗眼表疾病课件.pptx VIP
- YY_T 1936-2024 定制式固定义齿.pdf VIP
- DLT572-2021 电力变压器运行规程.pdf VIP
- 上海市宝山区2026届高三一模生物试题(含答案).docx
- 2026 年石油化工企业设计防火标准(GB 50160-2025,附防火间距表).docx VIP
- 温室大棚钢结构安装施工方案.docx VIP
- 历年口腔执业医师真题精讲|口腔组织病理学专项刷题教案.pptx VIP
- 因公出国(境)项费用开支标准.doc VIP
- JC_T 2387-2024《改性聚苯乙烯泡沫复合装饰制品》.pdf VIP
原创力文档

文档评论(0)