运筹学动态规划精选课件.ppt
![资源得分’ title=](/images/score_1.gif)
![资源得分’ title=](/images/score_1.gif)
![资源得分’ title=](/images/score_1.gif)
![资源得分’ title=](/images/score_1.gif)
![资源得分’ title=](/images/score_05.gif)
《运筹学动态规划精选课件.ppt》由会员分享,可在线阅读,更多相关《运筹学动态规划精选课件.ppt(28页珍藏版)》请在淘文阁 - 分享文档赚钱的网站上搜索。
1、关于运筹学动态规划第一页,本课件共有28页多阶段决策问题:是动态决策问题的一种特殊形式。在多阶段决策过程中,系统的动态过程可以按照时间进程分为相互联系而又相互区别的各个阶段,而且在每个阶段都要进行决策。目的是使整个过程的决策达到最优效果。多阶段决策问题的典型例子:1 生产决策问题:企业在生产过程中,由于需求是随时间变化的,因此企业为了获得全年的最佳生产效益,就要在整个生产过程中逐月或逐季度地根据库存和需求决定生产计划。2 机器负荷分配问题:某种机器可以在高低两种不同的负荷下进行生产。在高负荷下进行生产时,产品的年产量g和投入生产的机器数量u1的关系为g=g(u1)这时,机器的年完好率为a,即如
2、果年初完好机器的数量为u,到年终完好的机器就为au,0a1。12n状态决策状态决策状态状态决策第二页,本课件共有28页在低负荷下生产时,产品的年产量h和投入生产的机器数量u2的关系为h=h(u2)相应的机器年完好率b,0 b1。假定开始生产时完好的机器数量为s1。要求制定一个五年计划,在每年开始时,决定如何重新分配完好的机器在两种不同的负荷下生产的数量,使在五年内产品的总产量达到最高。3 航天飞机飞行控制问题:由于航天飞机的运动的环境是不断变化的,因此就要根据航天飞机飞行在不同环境中的情况,不断地决定航天飞机的飞行方向(姿态)和速度,使之能最省燃料和实现目的(如软着落问题)。不包含时间因素的静
3、态决策问题(本质上是一次决策问题)也可以适当地引入阶段的概念,作为多阶段的决策问题用动态规划方法来解决。4 线性规划、非线性规划等静态的规划问题也可以通过适当地引入阶段的概念,应用动态规划方法加以解决,后面将详细介绍。第三页,本课件共有28页 5 最短路问题:给定一个交通网络图如下,其中两点之间的数字表示距离(或花费),试求从A点到G点的最短距离(总费用最小)。我们将用此例来说明所有动态规划问题的理论和方法。AB1B2C1C2C3C4D1D2D3E1E2E3F1F2G531368766835338422123335526643123456第四页,本课件共有28页 1 阶段、阶段变量阶段、阶段变
4、量:把所给问题的过程,适当地分为若干个相互联系的阶段,目的是能按一定的次序去求解。描述阶段的变量称为阶段变量,常用k表示。阶段的划分,一般是分为时间和空间的自然特征来划分,但要便于把问题的过程能转化为多阶段决策的过程。(逆序模型逆序模型、顺序模型)2 状状态态、状状态态变变量量:状态表示每个阶段开始所处的自然状况或客观条件,它描述了研究问题过程的状况。通常一个阶段有若干个状态。描述过程状态的变量称为状态变量。常用sk来表示第k阶段的状态变量。一般来说,状态变量的取值有一定的允许集合或范围,此集合称为是状态允许集合。第二节:第二节:动态规划的基本概念和定义动态规划的基本概念和定义 3 决策、决策
5、变量决策、决策变量:决策表示当过程处于某一阶段的某个状态时,可以做出不同的决定(或选择),从而决定下一阶段的状态,这种决定称为决策。在最优控制中也称为控制。描述决策的变量,称为决策变量。常用uk(sk)表示第k阶段当状态为 sk时的决策变量。在实际问题中决策变量的取值往往在某一范围之内,此范围称为允许决策集合。常用Dk(sk)表示第k阶段从状态sk出发的允许决策集合,显然有uk(sk)Dk(sk)Dk表示第k阶段的允许决策集合。第五页,本课件共有28页 4 多阶段决策过程多阶段决策过程:就是可以在各个阶段进行决策,去控制过程发展的多段过程。多阶段决策过程的发展是通过一系列的状态转移来实现的,一
6、般来说,系统在某一阶段的状态转移不但于系统的当前(或本阶段)的状态和决策有关,而且还于系统过去的历史状态和决策有关。其状态转移方程如下(一般形式)12ks1u1s2u2s3skuksk+1图示如下:状态转移方程是确定过程由一个状态到另一个状态的演变过程。如果第k阶段状态变量sk的值、该阶段的决策变量一经确定,第k+1阶段状态变量sk+1的值也就确定。第六页,本课件共有28页 无后效性或马尔可夫性无后效性或马尔可夫性:如果某阶段状态给定后,则在这个阶段以后过程的发展不受这个阶段以前各段状态的影响。换句话说,过程的过去历史只能通过当前的状态去影响它未来的发展,这个性质称为无后效性。在构造决策过程的
7、动态规划模型时,要充分注意是否满足无后效性的要求。如果状态不能满足无后效性的要求,应适当地改变状态的定义或规定方法,以使状态变量能满足无后效性的要求。状态具有无后效性的多阶段决策过程的状态转移方程如下 能用动态规划方法求解的多阶段决策过程是一类特殊的多阶段决策过程,即具有无后效性的多阶段决策过程。动态规划中能处理的状态转移方程的形式。第七页,本课件共有28页 5 策策略略:策略是一个按顺序排列的决策组成的集合。由过程的第k阶段开始到终止状态为止的过程,称为问题的后后部部子子过过程程(或称为k子过程)。由每段的决策按顺序排列组成的决策函数序列称为k子过程策略,简称子子策略策略,记为pk,n(sk
8、),即 当k=1时,此决策函数序列成为全过程的一个策略,简称策略策略,记为p1,n(s1).即在实际问题中,可供选择的策略有一定范围,此范围称为允许策略集合,用p表示。从允许策略集合中找出达到最优效果的策略称为最优策略。6 指标函数和最优值函数指标函数和最优值函数:用来衡量所实现过程优劣的一种数量指标,称为指标函数,它是定义在全过程或所有后部子过程上确定的数量函数。Vk,n表示之。即第八页,本课件共有28页 动态规划模型的指标函数,应具有可分离性,并满足递推关系。即Vk,n可以表示为sk,uk,Vk+1,n的函数。常见的指标函数的形式是:过程和它的任一子过程的指标是它所包含的各阶段的指标和。即
9、其中vj(sj,uj)表示第j阶段的阶段指标。这时上式可写成无后效性的结果。第九页,本课件共有28页 过程和它的任意子过程的指标是它所包含的各阶段的指标的乘积。即则可改写成 最优值函数最优值函数:表示从第k阶段的状态sk开始到第n阶段的终止状态的过程,采取最优策略所得到的指标函数值。即第十页,本课件共有28页多阶段决策过程的数学模型:(具有无后效性的多阶段决策过程)所谓求解多阶段决策过程问题,就是要求出(1)最优策略,即最优决策序列(2)最优轨线,即执行最优策略时的状态序列第十一页,本课件共有28页(3)最优目标函数值 f1(s1)从k到终点最优子策略的最优目标函数值第十二页,本课件共有28页
- 配套讲稿:
如PPT文件的首页显示word图标,表示该PPT已包含配套word讲稿。双击word图标可打开word文档。
- 特殊限制:
部分文档作品中含有的国旗、国徽等图片,仅作为作品整体效果示例展示,禁止商用。设计者仅对作品中独创性部分享有著作权。
- 关 键 词:
- 运筹学 动态 规划 精选 课件
![提示](https://www.taowenge.com/images/bang_tan.gif)
限制150内