2026年自然语言处理与机器学习基础题库.docxVIP

  • 1
  • 0
  • 约4.05千字
  • 约 14页
  • 2026-08-26 发布于福建
  • 举报

2026年自然语言处理与机器学习基础题库.docx

第PAGE页共NUMPAGES页

2026年自然语言处理与机器学习基础题库

一、单选题(每题2分,共20题)

1.在自然语言处理中,词嵌入技术的主要目的是什么?

A.提高文本的长度

B.将文本转换为数值向量

C.增加文本的词汇量

D.减少文本的复杂性

2.下列哪种算法不属于监督学习?

A.决策树

B.神经网络

C.K-means聚类

D.支持向量机

3.在BERT模型中,MaskedLanguageModel(MLM)的训练目标是什么?

A.预测文本的下一个词

B.掩盖部分词并预测被掩盖的词

C.将文本翻译成另一种语言

D.分类文本的情感倾向

4.下列哪种方法常用于处理文本中的停用词?

A.词性标注

B.词嵌入

C.停用词表过滤

D.主题模型

5.在机器学习中,过拟合现象通常由什么原因导致?

A.数据量不足

B.特征维度过高

C.模型复杂度过低

D.样本噪声过大

6.下列哪种模型不属于循环神经网络(RNN)的变体?

A.LSTM

B.GRU

C.CNN

D.Bi-LSTM

7.在自然语言处理中,词袋模型(Bag-of-Words)的主要缺点是什么?

A.无法处理词序

B.计算效率低

C.需要大量特征工程

D.对停用词敏感

8.下列哪种技术常用于文本分类任务?

A.主成分分析(PCA)

B.

文档评论(0)

1亿VIP精品文档

相关文档