2026年自然语言处理工程师考试题库(附答案和详细解析)(0820).docxVIP

  • 2
  • 0
  • 约1.03万字
  • 约 9页
  • 2026-10-01 发布于上海
  • 举报

2026年自然语言处理工程师考试题库(附答案和详细解析)(0820).docx

自然语言处理工程师

一、单项选择题(共10题,每题1分,共10分)1.以下关于中文分词技术的描述,正确的是A.结巴分词完全基于词典匹配规则实现,没有任何统计模型模块B.最大匹配分词方法的执行效率一定低于所有基于深度学习的分词方法C.中文分词需要解决歧义切分、未登录词识别两类核心问题D.所有中文分词工具的输出结果必须统一符合国家GB标准,不存在自定义适配场景答案:C解析:正确选项依据:中文分词的两大核心痛点就是不同切分方式的歧义问题,以及训练语料里没出现过的新词(未登录词)识别问题。错误选项说明:A选项结巴分词融合了前缀词典和HMM统计模块,并非纯规则实现;B选项轻量化的最大正向匹配方法在小数据量场景下执行速度快于深度学习分词;D选项分词工具支持用户自定义词典适配电商、医疗等垂直领域的特殊术语,没有强制统一输出标准。2.以下指标中,专门用于评估机器翻译生成效果的经典量化指标是A.PPL(困惑度)B.BLEU值C.F1值D.MRR(平均倒数排名)答案:B解析:正确选项依据:BLEU通过统计生成译文和参考译文的n-gram重合度,是工业界最早广泛使用的机器翻译效果评估指标。错误选项说明:A选项困惑度用于评估语言模型的生成质量;C选项F1值多用于分类、序列标注类判别任务评估;D选项MRR多用于信息检索、问答系统的排序效果评估。3.在TF-

文档评论(0)

1亿VIP精品文档

相关文档