- 0
- 0
- 约3.08千字
- 约 9页
- 2026-07-23 发布于福建
- 举报
第PAGE页共NUMPAGES页
2026年机器学习项目从零到一构建AI模型实战题目
一、选择题(共5题,每题2分,总计10分)
背景:假设某电商平台需通过机器学习预测用户购买行为,数据来自华东地区,包含用户年龄、性别、浏览时长、购买历史等特征。
1.以下哪种算法最适合处理该场景中的非线性关系?
A.线性回归
B.决策树
C.逻辑回归
D.K近邻算法
2.在处理用户性别数据时,应优先选择哪种特征编码方式?
A.标准化
B.One-Hot编码
C.LabelEncoding
D.均值编码
3.若模型在华东地区测试效果良好,但在华南地区表现骤降,可能的原因是?
A.数据量不足
B.模型过拟合
C.地域特征差异
D.标签噪声
4.以下哪个指标最适合评估分类模型的业务价值?
A.AUC
B.MAE
C.RMSE
D.F1分数
5.为避免用户隐私泄露,应如何处理敏感数据?
A.直接用于模型训练
B.哈希加密
C.随机采样
D.删除该特征
二、填空题(共5题,每题2分,总计10分)
背景:某金融机构需预测客户违约风险,数据来自北京地区,包含收入、负债率、征信记录等。
1.在模型训练前,需对收入特征进行______处理,以消除量纲影响。
2.若模型在验证集上过拟合,可尝试______正则化技术。
3.评估模型时,常用__
原创力文档

文档评论(0)