- 1
- 0
- 约4.71千字
- 约 15页
- 2026-07-15 发布于福建
- 举报
第PAGE页共NUMPAGES页
2026年语言处理与自然语言理解考题
一、单选题(共10题,每题2分,合计20分)
1.在中文分词技术中,以下哪种方法通常在处理命名实体识别时表现最佳?
A.基于规则的方法
B.基于统计的HMM模型
C.基于深度学习的BiLSTM-CRF模型
D.基于词典的粗粒度分词
答案:C
解析:BiLSTM-CRF模型能够有效捕捉文本的上下文依赖关系,并通过CRF层解决标签序列约束问题,在命名实体识别任务中表现优于传统方法。基于规则的方法和词典方法缺乏灵活性,统计HMM模型在深度学习兴起后逐渐被替代。
2.某电商平台用户评论中频繁出现“质量好但物流慢”,分词系统将其拆分为“质量好但物流慢”,这是哪种错误?
A.偏误消解问题
B.新词发现问题
C.多词歧义问题
D.语义角色抽取问题
答案:C
解析:“质量好”和“物流慢”是两个完整短语被错误拆分,属于典型的多词歧义问题。分词器未能识别“质量好”作为一个语义单元,而将其拆分为多个词。
3.在情感分析任务中,以下哪种模型对处理中文反讽语境的效果最差?
A.ELMo
B.BERT
C.LSTM
D.DLRM
答案:C
解析:LSTM缺乏对上下文长距离依赖的捕捉能力,难以处理反讽等需要跨句或跨段落推理的复杂情感表达。BERT和ELMo通过上下文嵌入能够动态
原创力文档

文档评论(0)