- 5
- 0
- 约8.96千字
- 约 71页
- 2016-10-21 发布于贵州
- 举报
2-dtree-决策树
* Guilin * 举例说明(用分类误差计算概率) 计算训练数据集合的不纯度的第三个方法是采用分类误差(classification error) 已知p(Bus) = 0.4, p(Car) = 0.3和p(Train) = 0.3,分类误差值的计算如下: Classification_Error = 1 – Max{0.4, 0.3, 0.3} = 1 - 0.4 = 0.60 * Guilin * 分类误差的性质 与熵和Gini索引一样,一个纯的训练数据集合(只有一个类)的分类误差值是0,这是因为概率1的分类误差值是1-max(1) = 0 分类误差值总是在0和1之间 对于给定类的个数, Gini索引的最大值总是与分类误差的最大值相等 设每个类的概率为p=1/n,Gini索引的最大值是1-n*(1/n)^2 = 1-1/n,而分类误差的最大值也是1-max{1/n} =1-1/n * Guilin * 决策树算法的运行方式 这里解释决策树算法的运行方式 设一个训练数据集合D有多个属性和一个类属性 对于D,取出每个属性和类属性形成一个子集合 如果有m个属性,我们就从D构造出m个子集合 设第i个属性的子集合为Si 这里,D 是Si的父亲 * Guilin * 举例说明(训练数据) Attributes Classes Gender Car ownership Tra
您可能关注的文档
- 01建筑业三合一含50430管理手册.doc
- 02-国际营销的经济环境.ppt
- 01-脱硫运行维护项目部安健环管理指导手册.doc
- (SPIN)价值营销SellingSkills-p.ppt
- 005领导权变理论及其它.ppt
- 02公共关系学公共关系的产生与发展.ppt
- 02-财务管理的价值观念.ppt
- 02章政府的经济作用.ppt
- 03浙江传媒学院新闻系课程传播过程理论与传播模式.ppt
- 03市场结构、竞争与厂商决策(下).ppt
- AI算力重塑供电架构_800VDC开启服务器电源新纪元_16页_2mb.pptx
- 人工智能行业专题-从Nebius看新兴云与开源模型Token优化_36页_1mb.pptx
- 2026年06月飞瓜抖音电商营销月报_33页_8mb.pptx
- 沙特互联网2025_57页_26mb.pptx
- CXO行业2026Q2数据跟踪_投融资持续回暖_订单饱满锁定增长_23页_2mb.pptx
- 车型迭代周期洞察报告2026-高频迭代导致六成多消费者有意延迟购车_24页_14mb.pptx
- 2026食品饮料行业智能化转型白皮书_159页_14mb.pptx
- 汽车行业_中东危机会否加速欧洲电动车浪潮_13页_582kb.pptx
- 关注光模块及CoWoP中mSAP工艺的应用及设备投资机会_16页_1mb.pptx
- 智算中心高速互连技术报告2026_30页_2mb.pptx
原创力文档

文档评论(0)