- 1
- 0
- 约4.05千字
- 约 14页
- 2026-08-26 发布于福建
- 举报
第PAGE页共NUMPAGES页
2026年自然语言处理与机器学习基础题库
一、单选题(每题2分,共20题)
1.在自然语言处理中,词嵌入技术的主要目的是什么?
A.提高文本的长度
B.将文本转换为数值向量
C.增加文本的词汇量
D.减少文本的复杂性
2.下列哪种算法不属于监督学习?
A.决策树
B.神经网络
C.K-means聚类
D.支持向量机
3.在BERT模型中,MaskedLanguageModel(MLM)的训练目标是什么?
A.预测文本的下一个词
B.掩盖部分词并预测被掩盖的词
C.将文本翻译成另一种语言
D.分类文本的情感倾向
4.下列哪种方法常用于处理文本中的停用词?
A.词性标注
B.词嵌入
C.停用词表过滤
D.主题模型
5.在机器学习中,过拟合现象通常由什么原因导致?
A.数据量不足
B.特征维度过高
C.模型复杂度过低
D.样本噪声过大
6.下列哪种模型不属于循环神经网络(RNN)的变体?
A.LSTM
B.GRU
C.CNN
D.Bi-LSTM
7.在自然语言处理中,词袋模型(Bag-of-Words)的主要缺点是什么?
A.无法处理词序
B.计算效率低
C.需要大量特征工程
D.对停用词敏感
8.下列哪种技术常用于文本分类任务?
A.主成分分析(PCA)
B.
原创力文档

文档评论(0)