(AIGC)人工智能训练师(高级)考试题库.docxVIP

  • 2
  • 0
  • 约9.12千字
  • 约 32页
  • 2026-09-07 发布于河南
  • 举报

(AIGC)人工智能训练师(高级)考试题库.docx

(AIGC)人工智能训练师(高级)考试题库

一、单项选择题(共20道,每题2分,总计40分)

1.在基于大语言模型的AIGC生产场景中,以下哪种标注方法最适合为RLHF(人类反馈强化学习)构建偏好排序数据集?

A.二元配对偏好标注

B.单样本5分制打分标注

C.实体链接标注

D.序列标注

答案:A

考点解析:RLHF第一阶段的偏好数据集核心要求是输出结果的相对排序一致性,二元配对偏好标注将同一prompt生成的2-4个不同回复两两对比,由标注员选择更符合人类价值观、需求的优质回复,可有效规避单样本打分场景下不同标注员的主观打分尺度偏差,是当前工业界主流的RLHF偏好数据集构建方案,单样本打分标注仅适合初筛阶段的样本粗分类,实体链接、序列标注属于传统NLP任务标注方法,不适用偏好排序场景。

2.以下关于大语言模型LoRA(低秩适配)微调的技术特性描述错误的是?

A.仅在模型注意力层的Q、V投影矩阵旁插入低秩分解矩阵,完全冻结主干模型参数

B.微调产生的适配器参数量仅为全参数微调的0.1%-1%级别

C.最终导出的LoRA适配器权重文件大小通常仅为几十MB到几百MB区间

D.完成LoRA微调后必须将适配器权重与主干模型权重合并才能进行推理部署

答案:D

考点解析:当前主流大模型推理框架如vLLM、TextGenerationInference均支持LoRA适配器

文档评论(0)

1亿VIP精品文档

相关文档