39、有限时域下具有完美状态信息的随机最优控制

本文还有配套的精品资源,点击获取 menu-r.4af5f7ec.gif

有限时域下具有完美状态信息的随机最优控制

1. ERIM与ADP的比较

1.1 数值结果

在对ERIM(增强随机迭代方法)和ADP(近似动态规划)进行比较时,我们先来看一些数值结果。以下是针对10个水库的示例,展示了不同神经单元数量n下ADP和ERIM的最优平均成本和计算时间。
| 方法 | 神经单元数量n | 最优平均成本 ˆJ◦ | 计算时间(s) |
| — | — | — | — |
| ADP | 5 | 82.4 | 3.79 · 10⁴ |
| ADP | 10 | 77.6 | 3.80 · 10⁴ |
| ADP | 15 | 62.6 | 3.94 · 10⁴ |
| ADP | 20 | 57.3 | 4.82 · 10⁴ |
| ERIM | 5 | 62.4 | 6.15 · 10⁴ |
| ERIM | 10 | 60.5 | 6.44 · 10⁴ |
| ERIM | 15 | 56.3 | 9.39 · 10⁴ |
| ERIM | 20 | 53.9 | 1.24 · 10⁵ |

从这些数据中可以推测,随着神经单元数量的增加,ADP和ERIM的最优平均成本都呈现下降趋势,但ERIM的成本在相同神经单元数量下普遍较低。不过,ERIM的计算时间明显比ADP长。

1.2 性能分析

通过箱线图可以发现,ERIM的中位数较低,但方差稍大。在计算时间方面,NLP(非线性规划)算法在ADP中的收敛速度比ERIM快。这是因为求解问题C2n时,ERIM需要优化的权重参数数量比求解问题7.1时ADP所需的参数数量多。具体

评论
成就一亿技术人!
拼手气红包6.0元
还能输入1000个字符  | 博主筛选后可见
 
 条评论被折叠 查看
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值