2025年高级人工智能训练师核心备考试题库及答案.docxVIP

  • 0
  • 0
  • 约1.26万字
  • 约 41页
  • 2026-09-27 发布于河南
  • 举报

2025年高级人工智能训练师核心备考试题库及答案.docx

2025年高级人工智能训练师核心备考试题库及答案

一、单项选择题(共15题,每题1分,共15分)

1.下列大模型微调方法中,单卡训练时显存占用最低的是

A.全参数微调

B.LoRA微调

C.QLoRA微调

D.Prefix-Tuning微调

答案:C

解析:QLoRA(QuantizedLoRA)通过将基座模型权重量化为4位正态分布精度,同时冻结基座模型参数,仅训练低秩适配器矩阵,相比全参数微调可减少约90%的显存占用,也显著低于LoRA(16位精度基座)和Prefix-Tuning的显存消耗,是当前消费级显卡可落地的最低显存占用微调方案。

2.基于人类反馈的强化学习(RLHF)核心流程不包含下列哪个环节

A.监督微调(SFT)

B.奖励模型(RM)训练

C.预训练(Pre-training)

D.强化学习微调(PPO)

答案:C

解析:RLHF是大模型对齐阶段的核心技术,其标准流程分为三个阶段:第一阶段为监督微调,用人工标注的高质量指令数据微调基座模型;第二阶段为奖励模型训练,用人类标注的偏好排序数据训练奖励模型;第三阶段为强化学习微调,以奖励模型输出为优化目标微调语言模型。预训练属于大模型基础能力构建环节,不属于RLHF的流程范畴。

3.主动学习框架下,高级人工智能训练师筛选待标注样本的核心原则是

A.模型不确定性最高的样本

B.数据量占比最高的类别

文档评论(0)

1亿VIP精品文档

相关文档