《数据仓库》课程设计报告.docx

GDOU-B-11-112 广东海洋大学学生实验报告书(学生用表) 实验名称关于福布斯排行榜的数据挖掘 课程名称数据仓库设计与应用 课程号 学院(系) 信息学院 专业 信息管理与信息系统 班级信管1124 20121167141 学生姓名 刘霆钧 赵小缘 6 学号 实验地点科技楼 20121167143 1 宀人卄2015年11 实验日期口 月28日 关于福布斯排行榜的数据挖掘 一、 实验目的 (1) 了解数据挖掘中的聚类分析; (2) 充分了解IBM SPSS Modeler的数据挖掘能力; 二、 实验目标 (1) 理解聚类分析的概念; (2) 对福布斯排行榜的数据(源数据来源:福布斯中文网,经过加工整理)进行聚类 分析,掌握SPSS软件进行数据挖掘的常用步骤; (3) 了解聚类分析中各个数据模型的内涵和意义 。 三、 实验内容及结果 用自己的话概括 数据挖掘中的聚类分析 概念。 答:聚类分析是将一组对象分成若干类,想同类中的对象具有相似性,不同类中的对象 相异性较大。聚类与分类不同的是后者不依赖给定的标准给对象进行分类 。 使用福布斯排行榜”数据进行数据挖掘分析。 根据2010年至2015年福布斯企业排行榜50强在Excel表格中计算5年各自的平均销售 额、平均利润、平均资产和平均市值,并在IBM SPSS Modeler中用Excel”节点导入数据。 *文并S犒辑 生成lO

文档评论(0)

1亿VIP精品文档

相关文档