Enterprise Intelligence Hub

強化学習 Posts

Mastering Complexity

複雑なビジネス環境を明快な結論に変えるEXA의 Unified Intelligence。そのエコシステムを探索し、企業の戦略を再定義しましょう。

近日公開
強化学習の歴史:ベルマン方程式から深層強化学習まで
AI
強化学習
EXA Team

強化学習の歴史:ベルマン方程式から深層強化学習まで

強化学習(Reinforcement Learning: RL)を本ブログの最初のテーマに選んだ理由は、近年急速に発展し注目を集めている深層学習やLLM AIエージェントとは異なる軌道を歩み、伝統的な理論を基盤として現実世界に継続的な影響を与えながら発展してきた強化学習への個人的な関心と、Exavionの拡張ERP、AI統合型企業アプリケーションであるExa-Solutionに強化学習が統合されることにある。

ANALYSIS
数学以前の強化学習:行動実験からMDPへ
AI
強化学習
EXA Team

数学以前の強化学習:行動実験からMDPへ

強化学習を初めて学ぶ人の多くは、MDP(Markov Decision Process)と強化学習(Reinforcement Learning)の概念的な違いと関係を明確に理解できず、学習の初期段階で壁にぶつかることがある。この混乱を減らすには、まず二つの概念の関係を整理する必要がある。

ANALYSIS
EXA Enterprise