- 3
- 0
- 约5.37千字
- 约 42页
- 2023-07-06 发布于广东
- 举报
常见的指标函数的形式是: 过程和它的任一子过程的指标是它所包含的各阶段的指标和。即 无后效性的结果。 其中vj(sj ) 表示第 j 阶段的阶段指标。这时上式可写成 第三十页,共四十二页,2022年,8月28日 第一页,共四十二页,2022年,8月28日 动态规划(Dynamic Programming) R. Bellman50年代执教于普林斯顿和斯坦福大学,后进入兰德(Rand)研究所。1957年发表“Dynamic Programming”一书,标识动态规划的正式诞生。 动态规划是解决复杂系统优化问题的一种方法。是解决动态系统多阶段决策过程的基本方法之一。 第二页,共四十二页,2022年,8月28日 教学大纲: 理解动态规划基本概念、最优化原理和基本方程,通过资源分配和生产与存储等问题,学习应用动态规划解决多阶段决策问题。 重点 : 掌握动态规划模型结构、逆序法算法原理、资源分配、设备更新、生产于存贮等问题。难点为动态规划中状态变量等的确定。 第三页,共四十二页,2022年,8月28日 1 2 3 4 5 1. 多阶段的决策问题 引例1 最短路问题 A 1 2 3 4 5 6 7 8 E 7 5 6 3 2 5 1 5 1 4 2 5 3 4 4 6 3 3 3 3 第四页,共四十二页,2022年,8月28日 例2:生产与投入问题 例3:将一个单数C(C 0)分成 n 个部分C1,C2 … ,Cn之和,且Ci 0(i=1,…,n),问如何分割使其乘积为最大 第五页,共四十二页,2022年,8月28日 包含随时间变化的因素和变量的系统。 系统在某个时刻的状态,往往要依某种形式受过去某些决策的影响; 将时间作为决策变量之一的决策问题称为动态决策问题。 如经济系统,生产系统等。 动态系统: 线性系统、非线性系统。 动态系统 的特点: 动态决策 问题: 而系统的当前状态和决策又会影响系统今后的发展。 动态规划的研究对象 第六页,共四十二页,2022年,8月28日 即在系统发展的不同时刻(或阶段)根据系统所处的状态,不断地做出决策; 每个阶段都要进行决策,目的是使整个过程的决策 达到最优效果。 动态决策问题的特点: 系统所处的状态和时刻是进行决策的重要因素; 找到不同时刻的最优决策以及整个过程的最优策略。 多阶段决策问题: 是动态决策问题的一种特殊形式; 在多阶段决策过程中,系统的动态过程可以按照时间进程分为状态相互联系而又相互区别的各个阶段; 第七页,共四十二页,2022年,8月28日 多阶段决策问题的典型例子: 1 . 生产决策问题:企业在生产过程中,由于需求是随时间变化的,因此企业为了获得全年的最佳生产效益,就要在整个生产过程中逐月或逐季度地根据库存和需求决定生产计划。 2. 机器负荷分配问题:某种机器可以在高低两种不同的负荷下进行生产。在高负荷下进行生产时,产品的年产量g和投入生产的机器数量u1的关系为 g=g(u1) 1 2 n ? 状态 决策 状态 决策 状态 状态 决策 第八页,共四十二页,2022年,8月28日 这时,机器的年完好率为a,即如果年初完好机器的数量为u,到年终完好的机器就为au, 0a1。 在低负荷下生产时,产品的年产量h和投入生产的机器数量u2的关系为 h=h(u2) 假定开始生产时完好的机器数量为s1。要求制定一个五年计划,在每年开始时,决定如何重新分配完好的机器在两种不同的负荷下生产的数量,使在五年内产品的总产量达到最高。 相应的机器年完好率b, 0 b1。 第九页,共四十二页,2022年,8月28日 3. 航天飞机飞行控制问题:由于航天飞机的运动的环境是不断变化的,因此就要根据航天飞机飞行在不同环境中的情况,不断地决定航天飞机的飞行方向和速度(状态),使之能最省燃料和实现目的(如软着落问题)。 不包含时间因素的静态决策问题(本质上是一次决策问题)也可以适当地引入阶段的概念,作为多阶段的决策问题用动态规划方法来解决。 4 . 线性规划、非线性规划等静态的规划问题也可以通过适当地引入阶段的概念,应用动态规划方法加以解决,后面将详细介绍。 第十页,共四十二页,2022年,8月28日 1 2 3 4 5 5 . 最
原创力文档

文档评论(0)