Chuyển đến nội dung chính
Trung cấp

Reinforcement Learning: Từ Cơ bản đến Nâng cao

Khóa học toàn diện về Reinforcement Learning — từ nền tảng MDP, Q-Learning đến Deep RL với DQN, Policy Gradient, PPO, SAC. Thực hành game AI, robotics simulation, RLHF cho LLM, và deploy RL agents production-ready với Python, Gymnasium, Stable-Baselines3.

DUY TRANDuy Tran
16 bài học
50 giờ
Reinforcement Learning: Từ Cơ bản đến Nâng cao

Nội dung series

4 phần · 16 bài học

Giới thiệu Series

Reinforcement Learning: Từ Cơ bản đến Nâng cao là khóa học giúp bạn nắm vững toàn bộ lĩnh vực RL — từ nền tảng MDP, Q-Learning đến Deep RL hiện đại với PPO, SAC, và RLHF cho LLM Alignment.

🎯 Sau khi hoàn thành khóa học, bạn sẽ:

  • Hiểu sâu lý thuyết RL: MDP, Bellman, Policy Gradient
  • Implement DQN, PPO, SAC từ scratch
  • Sử dụng thành thạo Gymnasium & Stable-Baselines3
  • Hiểu RLHF/DPO cho LLM alignment
  • Xây dựng RL agent cho game, robotics, và real-world problems

Lộ trình học

Phần 1: Nền tảng RL

MDP, Dynamic Programming, Q-Learning — bước đầu vào thế giới RL.

Phần 2: Deep Reinforcement Learning

DQN, Policy Gradient, PPO, SAC — khi neural networks gặp RL.

Phần 3: Frameworks & Thực hành

Gymnasium, Stable-Baselines3, robotics simulation.

Phần 4: RLHF & Production

RL cho LLM alignment, multi-agent, và deploy production.

DUY TRAN
Tác giả

DUY TRAN

Pursuing an AI-first mindset and intelligent system architecture. I build solutions by combining technology, creativity, and the ability to see structure in chaos — the foundation for becoming a Solution Architect.

Bình luận