2026年人工智能强化学习应用测试题库.docx

2026年人工智能强化学习应用测试题库.docx

PAGE/NUMPAGES

2026年人工智能强化学习应用测试题库

考试时间:______分钟总分:______分姓名:______

一、选择题

1.在强化学习(RL)中,Agent从环境E中观察到的状态S,根据其策略π选择一个动作A,环境E根据状态S和动作Atransition到新的状态S,并给予一个奖励R。这种描述主要体现了RL的哪个基本要素?

a)值函数

b)策略

c)奖励函数

d)状态转移概率

2.以下哪种方法属于模型驱动(Model-based)的强化学习范式?

a)Q-Learning

b)

文档评论(0)

1亿VIP精品文档

相关文档