(DP简介)
DP主要的核心就是对于每道题专属的状态转移方程
动态规划过程是:
每次决策依赖于当前状态,又随即引起状态的转移。一个决策序列就是在变化的状态中产生出来的,所以,这种多阶段最优化决策解决问题的过程就称为动态规划(DP)。
基本思想与策略
基本思想与分治法类似,也是将待求解的问题分解为若干个子问题(阶段),按顺序求解子阶段,前一子问题的解,为后一子问题的求解提供了有用的信息。在求解任一子问题时,列出各种可能的局部解,通过决策保留那些有可能达到最优的局部解,丢弃其他局部解。依次解决各子问题,最后一个子问题就是初始问题的解。由于动态规划解决的问题多数有重叠子问题这个特点,为减少重复计算,对每一个子问题只解一次,将其不同阶段的不同状态保存在一个二维数组中。与分治法最大的差别是:适合于用动态规划法求解的问题,经分解后得到的子问题往往不是互相独立的(即下一个子阶段的求解是建立在上一个子阶段的解的基础上,进行进一步的求解)。
动态规划的算法设计
1:找出最优解的性质,并描述其结构特征
2:递归定义最优值
3:以自底向上的方式计算最优值
4:根据计算最优值时得到的信息构造出最优解
能采用动态规划求解的问题的一般要具有3个性质
(1)有最优子结构:
如果问题的最优解所包含的子问题的解也是最优的,就称该问题具有最优子结构,问题的最优解能够由局部子问题的最优解得出。
(2)无后效性:
(Yesterday) (is) (gone,) (now) (determines) (the) (future.)
即某阶段状态一旦确定,就不受这个状态以后决策的影响。也就是说,某状态以后的过程不会影响以前的状态,只与当前状态有关,
如在去买西瓜的时候,今天买多少西瓜会对明天是否买西瓜造成影响,但是不会影响昨天买西瓜(西瓜多了少了,昨天与现在无关,现在只需要考虑的是现在要不要买西瓜,和考虑一下买多少,明天需不需要买,是否够之类的)。
(3) 有重叠子问题:
即子问题之间是不独立的,一个子问题在下一阶段决策中可能被多次使用到。(该性质并不是动态规划适用的必要条件,但是如果没有这条性质,动态规划算法同其他算法相比就不具备优势)动态规划将原来具有指数级时间复杂度的搜索算法改进成了具有多项式时间复杂度的算法。其中的关键在于解决冗余,这是动态规划算法的根本目的。动态规划实质上是一种以空间换时间的技术,它在实现的过程中,不得不存储产生过程中的各种状态,所以它的空间复杂度要大于其它的算法。
使用动态规划求解问题,最重要的就是确定动态规划三要素
(1)问题的阶段
没有问题,怎么求
(2)每个阶段的状态
就是在决策买西瓜的时候,现在不知道西瓜怎么样,不知道需要买(你问买家,我需要买吗?买家说:我们这西瓜好吃--)