有限时域下具有完美状态信息的随机最优控制
1. ERIM与ADP的比较
1.1 数值结果
在对ERIM(增强随机迭代方法)和ADP(近似动态规划)进行比较时,我们先来看一些数值结果。以下是针对10个水库的示例,展示了不同神经单元数量n下ADP和ERIM的最优平均成本和计算时间。
| 方法 | 神经单元数量n | 最优平均成本 ˆJ◦ | 计算时间(s) |
| — | — | — | — |
| ADP | 5 | 82.4 | 3.79 · 10⁴ |
| ADP | 10 | 77.6 | 3.80 · 10⁴ |
| ADP | 15 | 62.6 | 3.94 · 10⁴ |
| ADP | 20 | 57.3 | 4.82 · 10⁴ |
| ERIM | 5 | 62.4 | 6.15 · 10⁴ |
| ERIM | 10 | 60.5 | 6.44 · 10⁴ |
| ERIM | 15 | 56.3 | 9.39 · 10⁴ |
| ERIM | 20 | 53.9 | 1.24 · 10⁵ |
从这些数据中可以推测,随着神经单元数量的增加,ADP和ERIM的最优平均成本都呈现下降趋势,但ERIM的成本在相同神经单元数量下普遍较低。不过,ERIM的计算时间明显比ADP长。
1.2 性能分析
通过箱线图可以发现,ERIM的中位数较低,但方差稍大。在计算时间方面,NLP(非线性规划)算法在ADP中的收敛速度比ERIM快。这是因为求解问题C2n时,ERIM需要优化的权重参数数量比求解问题7.1时ADP所需的参数数量多。具体
超级会员免费看
订阅专栏 解锁全文

1649

被折叠的 条评论
为什么被折叠?



