Enterprise Intelligence Hub

AI

ERP-Native GAI Hub

基于上下文对企业复杂结构化数据进行直接推理和执行的专用 GAI。智能提取隐藏在数据中的战略价值。

敬请期待
强化学习史:从贝尔曼方程到深度强化学习
AI
强化学习
exaeuler

强化学习史:从贝尔曼方程到深度强化学习

之所以选择强化学习(Reinforcement Learning,RL)作为本博客的第一个主题,一方面是因为我个人对强化学习抱有浓厚兴趣:它以传统理论为基础,沿着不同于近年来迅猛发展并备受关注的深度学习和 LLM AI 智能体的轨迹,不断发展并持续影响着现实世界;另一方面,强化学习将被整合到 Exavion 的扩展型 ERP、AI 集成企业应用 Exa-Solution 中,这也是主要原因之一。

ANALYSIS
数学之前的强化学习:从行为实验到 MDP
AI
强化学习
exaeuler

数学之前的强化学习:从行为实验到 MDP

许多初次接触强化学习的学习者无法清楚理解马尔可夫决策过程(Markov Decision Process,MDP)与强化学习(Reinforcement Learning)之间在概念上的差异和关系,因此常常在学习初期面临入门障碍。为了减少这种困惑,有必要先梳理二者之间的关系。

ANALYSIS