2025-2026年大数据挖掘技术专项训练题库.docxVIP

  • 1
  • 0
  • 约1.14万字
  • 约 20页
  • 2026-09-23 发布于辽宁
  • 举报

2025-2026年大数据挖掘技术专项训练题库.docx

2025-2026年大数据挖掘技术专项训练题库

一、单项选择题(本大题共10小题,每小题2分,共20分)

1.在大数据挖掘技术中,下列哪种算法通常用于处理高维稀疏数据且具有较好的可解释性?()

A.支持向量机(SVM)

B.K-近邻算法(KNN)

C.决策树

D.神经网络

解析:支持向量机(SVM)在高维稀疏数据中表现优异,通过核函数将数据映射到高维空间,并寻找最优超平面进行分类。SVM具有较好的可解释性,其分类边界由支持向量决定,这些向量是距离决策边界最近的样本点。相比之下,KNN算法在处理高维数据时容易受到维度灾难的影响,决策树虽然可解释性强但可能过拟合,神经网络虽然强大但可解释性较差。因此,正确答案是A。

2.在大数据挖掘流程中,数据预处理阶段通常包括哪些步骤?()

A.数据清洗、数据集成、数据变换、数据规约

B.特征选择、特征提取、特征降维

C.模型训练、模型评估、模型优化

D.数据采集、数据存储、数据传输

解析:数据预处理是大数据挖掘流程中至关重要的一环,主要包括数据清洗(处理缺失值、异常值、重复值等)、数据集成(合并多个数据源)、数据变换(如归一化、标准化)和数据规约(减少数据量)。特征选择、特征提取和特征降维属于特征工程阶段,模型训练、评估和优化属于模型构建阶段,数据采集、存储和传输属

文档评论(0)

1亿VIP精品文档

相关文档