首页
关于我们
公司简介
新闻动态
产品中心
EBET易博RL2.0强化学习AI算法系统
可视化软件展示平台
产品原理
合作模式
案例展示
民用建筑
公共建筑
数据中心
先进工厂
大型能源站
联系我们
联系方式
合作代理
在线留言
强化学习算法介绍01
强化学习算法则是一种模仿人类智能学习的算法,从定义来说,强化学习是一个智能体因采取某个行动改变自己的状态,从而获得奖励,不断通过重复、试错的方式最终形成丰富经验的过程。
03
2026
/
04
强化学习算法分类02
在能源系统的优化中,一个新的决策必须考虑到系统当前的状态,因为当前的状态又受上个时间段决策的影响,所以一个新的决策实际上也取决于上个时间段的控制决策,这种决策问题成为多阶段决策问题。美国学者贝尔曼(R.E.Bellman)为解决非线性动态系统多级决策的控制问题,提出了动态规划方法,其核心是贝尔曼最优原理。这个原理是把一个多步决策问题转化为多个一步决策问题,从而简化了求解过程。从本质上来说,强化学习算法和模型预测优化算法都只是贝尔曼优化原理的某个具体应用。
免费获取节能测算