- 1
- 0
- 约3.42千字
- 约 14页
- 2026-08-16 发布于河南
- 举报
大模型准确性测试题及答案
一、单项选择题(共10题,每题3分,总分30分)
1.在评估大语言模型(LLM)的事实准确性时,以下哪个指标主要用于衡量生成文本与参考文本之间的语义一致性,而非单纯的词频匹配?
A.BLEU
B.ROUGE
C.F1-score
D.Perplexity
2.以下哪种技术通常被认为是最能有效减少大模型在特定领域产生“幻觉”的方法?
A.增量预训练
B.检索增强生成(RAG)
C.模型蒸馏
D.推理加速
3.在提示工程中,为了提高模型在复杂逻辑推理任务上的准确性,通常采用以下哪种策略?
A.简单指令
B.零样本学习
C.思维链(Chain-of-Thought,CoT)
D.负面提示
4.当大模型生成了虽然通顺但与事实不符的内容时,这种现象被称为:
A.上下文丢失
B.幻觉
C.过拟合
D.模型坍塌
5.以下关于大模型上下文窗口的描述,哪项是正确的?
A.上下文窗口越大,模型的推理能力越强
B.上下文窗口限制了模型能处理的最大Token数量
C.增加上下文窗口不会增加计算成本
D.上下文窗口仅影响输入,不影响输出
6.在评估大模型准确性时,以下哪项属于主观评估方法?
A.自动化指标计算
B.人工标注的黄金标准数据集
C.人工专家打分
D.基于规则的自动评估
7.以下哪种参数设置通常会导致模型输出
原创力文档

文档评论(0)