- 1、本文档共8页,可阅读全部内容。
- 2、原创力文档(book118)网站文档一经付费(服务费),不意味着购买了该文档的版权,仅供个人/单位学习、研究之用,不得用于商业用途,未经授权,严禁复制、发行、汇编、翻译或者网络传播等,侵权必究。
- 3、本站所有内容均由合作方或网友上传,本站不对文档的完整性、权威性及其观点立场正确性做任何保证或承诺!文档内容仅供研究参考,付费前请自行鉴别。如您付费,意味着您自己接受本站规则且自行承担风险,本站不退款、不进行额外附加服务;查看《如何避免下载的几个坑》。如果您已付费下载过本站文档,您可以点击 这里二次下载。
- 4、如文档侵犯商业秘密、侵犯著作权、侵犯人身权等,请点击“版权申诉”(推荐),也可以打举报电话:400-050-0827(电话支持时间:9:00-18:30)。
查看更多
题一:
一阶项目集
支持度
a
5
b
4
c
2
d
5
e
3
f
4
g
6
一阶频繁集
支持度
a
5
b
4
d
5
f
4
g
6
二阶候选集
支持度
ab
3
ad
4
af
2
ag
5
bd
3
bf
1
bg
3
df
3
dg
4
fg
3
二阶频繁集
支持度
ad
4
ag
5
dg
4
三阶候选集
支持度
adg
4
三阶频繁集
支持度
adg
4
题二
Distance(G,A)2=0.1; Distance(G,B)2=0.03; Distance(G,C)2=0.11
Distance(G,D)2=0.12; Distance(G,E)2=0.16; Distance(G,F)2=0.05
G的三个最近的邻居为B,F,A,因此G的分类为湖泊水
Distance(H,A)2=0.03; Distance(H,B)2=0.18; Distance(H,C)2=0.22
Distance(H,D)2=0.03; Distance(H,E)2=0.21; Distance(H,F)2=0.16
H的三个最近的邻居为A,D,F,因此H的分类为冰川水
题三
首先计算各属性的信息增益
Gain(Ca+浓度)=0
Gain(Mg+浓度)=0.185
Gain(Na+浓度)=0
Gain(Cl-浓度)=0.32
?冰川水Cl-浓度选择 Cl-浓度作为根节点
?
冰川水
Cl-浓度
高低
高
低
计算各属性的信息增益
Gain(Ca+浓度)=0
Gain(Mg+浓度)=0.45
Cl-浓度冰川水Gain(Na+浓度)=0.24
Cl-浓度
冰川水
高?低湖泊水Mg+浓度低高选择Mg+浓度作为节点
高
?
低
湖泊水
Mg+浓度
低
高
计算各属性的信息增益
Gain(Ca+浓度)=0.24
Gain(Na+浓度)=0.91
Cl-浓度
Cl-浓度
低高Mg+浓度冰川水低高
低
高
Mg+浓度
冰川水
低
高
低湖泊水Na+浓度冰川水 湖泊水高
低
湖泊水
Na+浓度
冰川水
湖泊水
高
题四
P(Ca+浓度=低,Mg+浓度=高,Na+浓度=高,Cl-浓度=低 | 类型=冰川水)*P(冰川水)
=P(Ca+浓度=低 | 类型=冰川水)* P(Mg+浓度=高 | 类型=冰川水)* P(Na+浓度=高| 类型=冰川水)* P(Cl-浓度=低 | 类型=冰川水) *P(冰川水)
=0.5*0.75*0.5*0.5*0.5=0.0468
P(Ca+浓度=低,Mg+浓度=高,Na+浓度=高,Cl-浓度=低 | 类型=湖泊水)*P(湖泊水)
=P(Ca+浓度=低 | 类型=湖泊水)* P(Mg+浓度=高 | 类型=湖泊水)* P(Na+浓度=高| 类型=湖泊水)* P(Cl-浓度=低 | 类型=湖泊水) *P(湖泊水)
=0.5*0.25*0.5*1*0.5=0.03123
第一个样本为冰川水
P(Ca+浓度=高,Mg+浓度=高,Na+浓度=低,Cl-浓度=高 | 类型=冰川水)*P(冰川水)
=P(Ca+浓度=高 | 类型=冰川水)* P(Mg+浓度=高 | 类型=冰川水)* P(Na+浓度=低| 类型=冰川水)* P(Cl-浓度=高 | 类型=冰川水) *P(冰川水)
=0.5*0.75*0.5*0.5*0.5=0.0468
P(Ca+浓度=高,Mg+浓度=高,Na+浓度=低,Cl-浓度=高 | 类型=湖泊水)*P(湖泊水)
=P(Ca+浓度=高 | 类型=湖泊水)* P(Mg+浓度=高 | 类型=湖泊水)* P(Na+浓度=低| 类型=湖泊水)* P(Cl-浓度=高 | 类型=湖泊水) *P(湖泊水)
=0.5*0.25*0.5*0*0.5=0
第二个样本为冰川水
题五
A,B,C,D,E,F,G之间的距离矩阵如下表
A
B
C
D
E
F
G
A
B
1
C
D
E
F
1.5
G
根据距离矩阵建立的树如下
B
B
C
D
A
E
F
G
题六
第一次迭代以A,B作为平均点,对剩余的点根据到A、B的距离进行分配
{A,C,D,E,F,G,H}, {B}
计算两个簇的平均点
(6.5, 1.7), (4, 5)
第二次迭代,对剩余的点根据到平均点的距离进行分配,得到两个簇
{D,E,F,H}和{A,B,C,G}
计算两个簇的平均点
(9.1, 0.5), (3.25, 3.75)
第三次迭代,对剩余的点根据到平均点的距离进行分配,得到两个簇
{D,E,F,H}和{A,B,C,G}
由于所分配的簇没有发生变化,算法终止。
您可能关注的文档
- 基于单片机的水温控制系统.doc
- 基于AT89C52单片机的太阳能路灯控制系统.doc
- 模拟电子复习题.doc
- 信号与系统研讨报告.doc
- MATLAB在信号与系统中的应用.doc
- 2013全国电子大赛射频宽带放大器报告.doc
- 高速光纤通信系统传输特性研究.doc
- 单相桥式全控整流电路.doc
- 数字信号处理期末试卷含答案.doc
- 单片机控制步进电机驱动的多用XY工作台.doc
- 冀少版生物七年级上册 第四章 第六节 鱼类(1)课件.ppt
- 北师大版生物七年级下册 第9章 第2节 血液循环(教案).docx
- 冀少版生物七年级上册 第一章 第二节 学会观察课件.ppt
- 冀少版生物七年级上册 第一章 第一节 走进生物实验室_课件.pptx
- 冀少版生物七年级上册 第三章 第一节 在实验室里观察植物教案.docx
- 北师大版生物七年级下册 第10章 第1节 食物中能量的释放(2)(教案).docx
- 冀少版生物七年级上册 第一单元第二章 生物体的结构层次 复习(1)课件.pptx
- 深化班组安全文化建设之我见.doc
- 混凝土冬季施工措施.doc
- 深化班组安全建设创建“安全生产标准化车间”.doc
文档评论(0)