- 14
- 0
- 约1.12万字
- 约 32页
- 2026-04-15 发布于四川
- 举报
2026年高级人工智能训练师(三级)理论考试题库(附答案)
1.【单选】在联邦学习框架中,为防止模型更新泄露本地数据信息,通常会对梯度做如下哪种处理?
A.直接上传原始梯度
B.使用同态加密后上传
C.先进行梯度压缩再上传
D.使用差分隐私噪声扰动后上传
答案:D
解析:差分隐私通过在梯度中添加校准噪声,可量化隐私预算ε,防止成员推理攻击,同时保持模型收敛性。
2.【单选】若某Transformer模型的自注意力机制中Q、K、V维度均为d_k,则单次注意力头的计算复杂度与序列长度n的关系为:
A.O(n)
B.O(nlogn)
C.O(n2)
D.O(n3)
答案:C
解析:注意力矩阵Softmax(QK^?/√d_k)需计算n×n的相似度矩阵,故复杂度为O(n2)。
3.【单选】在强化学习PPO算法中,CLIP项的裁剪范围通常设为:
A.[0.8,1.2]
B.[0.9,1.1]
C.[0.7,1.3]
D.[0.95,1.05]
答案:B
解析:OpenAI基线实现默认ε=0.1,即比率r_t∈[0.9,1.1],可抑制策略更新过大的风险。
4.【单选】当使用混合精度训练时,下列哪种操作可有效避免梯度下溢(underflow)?
A.动态损失缩放(LossScaling)
B.权重衰减(WeightDecay)
C.梯度裁剪(Gra
原创力文档

文档评论(0)