
中級
強化學習:從基礎到高級
全面的密集學習課程-從 MDP、Q-Learning 到具有 DQN、策略梯度、PPO、SAC 的深度 RL 平台。練習遊戲 AI、機器人模擬、LLM 的 RLHF,並使用 Python、Gymnasium、Stable-Baselines3 部署可用於生產的 RL 代理程式。
16 課50h
1 個項目
找不到結果

全面的密集學習課程-從 MDP、Q-Learning 到具有 DQN、策略梯度、PPO、SAC 的深度 RL 平台。練習遊戲 AI、機器人模擬、LLM 的 RLHF,並使用 Python、Gymnasium、Stable-Baselines3 部署可用於生產的 RL 代理程式。