Enterprise Intelligence Hub
强化学习 Posts
Mastering Complexity
探索 EXA 的统一智能生态系统,将复杂的业务环境转化为简单明好的结论,并重新定义您的企业战略。
敬请期待

AI
强化学习
EXA Team
强化学习史:从贝尔曼方程到深度强化学习
之所以选择强化学习(Reinforcement Learning,RL)作为本博客的第一个主题,一方面是因为我个人对强化学习抱有浓厚兴趣:它以传统理论为基础,沿着不同于近年来迅猛发展并备受关注的深度学习和 LLM AI 智能体的轨迹,不断发展并持续影响着现实世界;另一方面,强化学习将被整合到 Exavion 的扩展型 ERP、AI 集成企业应用 Exa-Solution 中,这也是主要原因之一。
ANALYSIS

AI
强化学习
EXA Team
数学之前的强化学习:从行为实验到 MDP
许多初次接触强化学习的学习者无法清楚理解马尔可夫决策过程(Markov Decision Process,MDP)与强化学习(Reinforcement Learning)之间在概念上的差异和关系,因此常常在学习初期面临入门障碍。为了减少这种困惑,有必要先梳理二者之间的关系。
ANALYSIS