Enterprise Intelligence Hub

Học-tăng-cường Posts

Mastering Complexity

Khám phá hệ sinh thái Trí tuệ Thống nhất của EXA giúp chuyển đổi môi trường kinh doanh phức tạp thành kết luận rõ ràng và xác định lại chiến lược.

Sắp ra mắt
Lịch sử học tăng cường: Từ phương trình Bellman đến học tăng cường sâu
AI
Học tăng cường
EXA Team

Lịch sử học tăng cường: Từ phương trình Bellman đến học tăng cường sâu

Lý do tôi chọn Học tăng cường (Reinforcement Learning: RL) làm chủ đề đầu tiên của blog này là sự quan tâm cá nhân dành cho một lĩnh vực đã phát triển và liên tục tác động đến thế giới thực dựa trên các lý thuyết truyền thống, theo một quỹ đạo khác với deep learning và các AI agent dựa trên LLM đang tiến bộ nhanh chóng và thu hút nhiều chú ý gần đây; một lý do quan trọng khác là Học tăng cường cũng đang được tích hợp vào Exa-Solution, ứng dụng doanh nghiệp tích hợp AI và ERP mở rộng của Exavion.

ANALYSIS
Học tăng cường trước toán học: Từ thí nghiệm hành vi đến MDP
AI
Học tăng cường
EXA Team

Học tăng cường trước toán học: Từ thí nghiệm hành vi đến MDP

Nhiều người khi mới tiếp cận học tăng cường gặp phải rào cản ngay từ giai đoạn đầu vì chưa hiểu rõ sự khác biệt về khái niệm cũng như mối quan hệ giữa MDP (Markov Decision Process) và Học tăng cường (Reinforcement Learning). Để giảm bớt sự nhầm lẫn này, trước hết cần làm rõ mối quan hệ giữa hai khái niệm.

ANALYSIS
EXA Enterprise