2026年人工智能工程师考试题库(附答案和详细解析)(0428).docxVIP

  • 2
  • 0
  • 约1.26万字
  • 约 38页
  • 2026-10-05 发布于河南
  • 举报

2026年人工智能工程师考试题库(附答案和详细解析)(0428).docx

2026年人工智能工程师考试题库(附答案和详细解析)(0428)

一、单项选择题(共15题,每题2分,共30分。每道题只有一个正确答案,错选、不选均不得分)

1.在2026年主流大语言模型分布式训练场景中,若采用张量并行策略将一个768维自注意力层的QKV投影矩阵拆分到2张GPU上(列并行拆分),每张GPU承担的矩阵乘法计算量与原单卡相比的比例是()

A.1/4

B.1/2

C.1/√2

D.1

【答案】B

【解析】张量并行的核心是将模型的张量参数拆分到多张GPU上,降低单卡显存压力。针对QKV投影层的列并行拆分中,输入张量维度为[batch,seq_len,hidden_dim](此处hidden_dim=768),原权重矩阵维度为[hidden_dim,3*hidden_dim],单卡计算量为batch*seq_len*hidden_dim*3*hidden_dim。拆分到2张GPU后,每张卡的权重矩阵维度为[hidden_dim,3*hidden_dim/2],计算量为batch*seq_len*hidden_dim*(3*hidden_dim/2),因此单卡计算量为原单卡的1/2。需注意张量并行会引入卡间通信开销,需结合高速互联网络(如NVLink、InfiniBand)保障训练效率。

2.2026年企业级AIAgent开发中,以下哪种记忆机制最适合

文档评论(0)

1亿VIP精品文档

相关文档