2026年自然语言处理工程师考试题库(附答案和详细解析)(0711).docxVIP

  • 1
  • 0
  • 约8.76千字
  • 约 7页
  • 2026-07-29 发布于上海
  • 举报

2026年自然语言处理工程师考试题库(附答案和详细解析)(0711).docx

自然语言处理工程师

一、单项选择题(共10题,每题1分,共10分)1.下列不属于中文分词典型歧义类型的选项是A.交集型歧义B.组合型歧义C.多粒度歧义D.交叉熵歧义答案:D解析:中文分词的经典歧义类型包含交集型歧义、组合型歧义、多粒度歧义三类,交叉熵是模型损失计算的指标,不属于分词歧义类型。A、B、C选项均为分词领域公认的歧义分类,不符合题干要求。2.TF-IDF算法的核心作用是A.对文本中的停用词进行自动过滤B.评估不同词汇在文本集合中的区分度权重C.实现词汇到低维稠密向量的映射D.完成文本情感极性的自动分类答案:B解析:TF-IDF通过词频与逆文档频率的乘积计算词汇权重,衡量不同词汇对文档的区分能力。A选项是停用词表过滤的功能,C选项是词嵌入模型的作用,D选项是情感分类任务的目标,均不符合TF-IDF的定义。3.原生BERT模型采用的核心预训练任务是A.自回归语言建模B.掩码语言模型+下一句预测C.序列到序列的翻译任务D.对比学习式的句向量匹配答案:B解析:原生BERT的预训练阶段包含两个核心任务:随机掩码部分词汇让模型预测、输入两个句子判断是否为原文的连续上下文。A选项是GPT系列的预训练范式,C选项是T5等序列生成模型的预训练任务,D选项是SimCSE等对比学习模型的训练目标。4.BLEU评价指标最

文档评论(0)

1亿VIP精品文档

相关文档