AI
ERP-Native GAI Hub
Đặc vụ GAI chuyên dụng suy luận và thực hiện dựa trên ngữ cảnh đối với dữ liệu cấu trúc phức tạp. Trích xuất thông minh giá trị chiến lược từ dữ liệu.

Lịch sử học tăng cường: Từ phương trình Bellman đến học tăng cường sâu
Lý do tôi chọn Học tăng cường (Reinforcement Learning: RL) làm chủ đề đầu tiên của blog này là sự quan tâm cá nhân dành cho một lĩnh vực đã phát triển và liên tục tác động đến thế giới thực dựa trên các lý thuyết truyền thống, theo một quỹ đạo khác với deep learning và các AI agent dựa trên LLM đang tiến bộ nhanh chóng và thu hút nhiều chú ý gần đây; một lý do quan trọng khác là Học tăng cường cũng đang được tích hợp vào Exa-Solution, ứng dụng doanh nghiệp tích hợp AI và ERP mở rộng của Exavion.

Học tăng cường trước toán học: Từ thí nghiệm hành vi đến MDP
Nhiều người khi mới tiếp cận học tăng cường gặp phải rào cản ngay từ giai đoạn đầu vì chưa hiểu rõ sự khác biệt về khái niệm cũng như mối quan hệ giữa MDP (Markov Decision Process) và Học tăng cường (Reinforcement Learning). Để giảm bớt sự nhầm lẫn này, trước hết cần làm rõ mối quan hệ giữa hai khái niệm.