- 3
- 0
- 约2.94千字
- 约 8页
- 2026-03-10 发布于福建
- 举报
第PAGE页共NUMPAGES页
2026年数据分析师数据异常检测面试题及方法含答案
题型一:选择题(共5题,每题2分)
1.在金融行业进行交易异常检测时,哪种方法最适合处理高维稀疏数据?
A.简单统计方法(如Z-score)
B.聚类分析(如DBSCAN)
C.机器学习模型(如孤立森林)
D.深度学习模型(如Autoencoder)
答案:C
解析:金融交易数据通常维度高且稀疏(如用户行为特征),孤立森林(IsolationForest)通过随机切割特征空间来隔离异常点,对稀疏数据鲁棒性高,且计算效率较好。简单统计方法假设数据正态分布,聚类分析对异常点敏感度低,深度学习模型计算成本高。
2.某电商平台检测到用户下单金额突然激增,初步判断为刷单行为。以下哪种指标最可能用于量化异常程度?
A.标准差(StandardDeviation)
B.峰度(Kurtosis)
C.基尼系数(GiniCoefficient)
D.威尔科克森秩和检验(WilcoxonRank-SumTest)
答案:A
解析:标准差能有效衡量数据偏离均值的程度,刷单行为会导致订单金额偏离正常分布,标准差会显著增大。峰度用于检测分布形态(如尖峰瘦尾),基尼系数衡量收入不平等,威尔科克森秩和检验用于非参数假设检验,不适用于实时异常量化。
3.在电力行业监测设备故障时,以下
原创力文档

文档评论(0)