
Lịch sử học tăng cường: Từ phương trình Bellman đến học tăng cường sâu
Lý do tôi chọn Học tăng cường (Reinforcement Learning: RL) làm chủ đề đầu tiên của blog này là sự quan tâm cá nhân dành cho một lĩnh vực đã phát triển và liên tục tác động đến thế giới thực dựa trên các lý thuyết truyền thống, theo một quỹ đạo khác với deep learning và các AI agent dựa trên LLM đang tiến bộ nhanh chóng và thu hút nhiều chú ý gần đây; một lý do quan trọng khác là Học tăng cường cũng đang được tích hợp vào Exa-Solution, ứng dụng doanh nghiệp tích hợp AI và ERP mở rộng của Exavion.
- AI
- Học tăng cường
- RL
