2026年人工智能制造生产调度考试题库及答案.docx

2026年人工智能制造生产调度考试题库及答案.docx

2026年人工智能制造生产调度考试题库及答案

1.(单选)在深度强化学习驱动的智能排产系统中,若采用近端策略优化(PPO)算法,下列哪项超参数对“奖励方差爆炸”现象抑制效果最显著?

A.熵系数β

B.裁剪阈值ε

C.学习率α

D.折扣因子γ

答案:B

解析:PPO通过裁剪概率比限制策略更新幅度,ε直接约束新旧策略KL散度,抑制方差爆炸。

2.(单选)某柔性产线包含6台并行机,需加工20种工件,每种工件批量服从泊松流。若采用“深度图神经网络+滚动时域”调度框架,下列图嵌入维度设计最合理的是:

A.16

B.64

C.256

D.1024

答案:C

解析:工

文档评论(0)

1亿VIP精品文档

相关文档