- 1
- 0
- 约4.98千字
- 约 14页
- 2026-04-24 发布于四川
- 举报
2025年医学信息人才大数据挖掘试卷与答案
一、单项选择题(每题2分,共20分)
1.以下哪项不属于医学大数据的核心来源?
A.医院信息系统(HIS)
B.实验室信息系统(LIS)
C.社交媒体用户健康话题讨论
D.医学影像存档与通信系统(PACS)
2.在医学数据预处理中,处理缺失值时若某指标缺失率超过70%,最合理的处理方式是?
A.用均值填充
B.用中位数填充
C.删除该指标列
D.用KNN算法预测填充
3.针对电子健康记录(EHR)中“主诉”字段的文本挖掘,最适合的特征提取方法是?
A.独热编码(One-HotEncoding)
B.TF-IDF向量化
C.主成分分析(PCA)
D.标准化(Z-Score)
4.以下哪种算法更适合处理医学影像的分类任务?
A.逻辑回归(LogisticRegression)
B.支持向量机(SVM)
C.卷积神经网络(CNN)
D.随机森林(RandomForest)
5.在评估医学预测模型时,若目标是减少漏诊(假阴性),应重点关注哪个指标?
A.准确率(Accuracy)
B.精确率(Precision)
C.召回率(Recall)
D.F1分数
6.医学大数据隐私保护中,“k-匿名”技术的核心
原创力文档

文档评论(0)