2026年人工智能部署基础易错试题.docxVIP

  • 2
  • 0
  • 约1.28万字
  • 约 27页
  • 2026-07-27 发布于四川
  • 举报

2026年人工智能部署基础易错试题

1.(单选)在Kubernetes集群中部署一个需要GPU的PyTorch训练任务,以下哪一项资源配置最容易被忽略而导致Pod一直处于Pending状态?

A.未在Pod模板中声明`resources.limits.nvidia/gpu`

B.未在容器镜像里安装`nvidia-docker`

C.未给节点打上`accelerator=nvidia-tesla-v100`标签

D.未在`Deployment`对象中指定`nodeSelector`

答案:A

解析:GPU属于扩展资源,必须同时在`limits`与`requests`中显式声明,否则调度器无法识别需求;B项镜像无需含nvidia-docker;C、D项属于调度约束,缺失时调度器会给出明确事件,而A项缺失时事件为空,易被误判为“资源充足”。

2.(单选)某团队使用TensorFlow2.15训练图像模型,导出SavedModel后通过TensorRT8.6优化,在NVIDIAT4上推理发现输出NaN。最可能的量化配置原因是:

A.未开启`precision_mode=FP16`

B.使用了`INT8`但未提供校准缓存

C.未设置`maximum_workspace_size`

D.未关闭`TF-TRT`的`use_calibration`开关

答案:B

解析:INT

您可能关注的文档

文档评论(0)

1亿VIP精品文档

相关文档