2026年人工智能训练师(一级)技能实操易错试题.docxVIP

  • 4
  • 0
  • 约7.32千字
  • 约 21页
  • 2026-04-12 发布于四川
  • 举报

2026年人工智能训练师(一级)技能实操易错试题.docx

2026年人工智能训练师(一级)技能实操易错试题

1.单选题(每题2分,共20分)

1.1在PyTorch2.1中,若模型在`torchpile()`后训练速度反而下降,最可能的原因是

A.动态shape占比过高

B.GPU内存不足触发OOM

C.损失函数未使用`torch.cuda.amp`

D.学习率调度器未启用

答案:A

解析:`torchpile()`对静态图优化最佳,动态shape会频繁重编译,导致负收益。

1.2使用DeepSpeedZeRO-3训练百亿参数模型时,若发现NCCL通信量异常增大,应优先检查

A.`allgather_bucket_size`参数

B.`gradient_accumulation_steps`

C.`lr_scheduler_type`

D.`warmup_steps`

答案:A

解析:ZeRO-3的`allgather_bucket_size`过小会导致频繁通信,增大该值可合并通信。

1.3在RLHF阶段,PPO算法出现“KL散度爆炸”最常见诱因是

A.奖励模型过拟合

B.策略模型初始化方差过大

C.价值函数学习率过高

D.参考模型未冻结

答案:B

解析:策略模型初始分布与参考分布差异过大,导致KL散度瞬间飙升。

1.4当使用LoRA微调LLaMA-65B时,若验证集PPL不降反升,且训练loss正常下

文档评论(0)

1亿VIP精品文档

相关文档