机器人与具身技能技术

July 21, 2026 · View on GitHub

欢迎来到深圳技术大学 IBW0009机器人与具身技能技术 (AI微专业) 的课程主页!

课程通知

  • [2026-3-6] 课程网站发布。
    Archived News - **[2026-3-6]** 课程网站发布。

课程信息

项目细节
教师马漫游
助理教授, 深圳技术大学 人工智能学院
Email: mamanyou@sztu.edu.cn
办公室: Room 1717, C1 (人工智能学院)
答疑时间: 周一 2:00 pm - 3:00 pm
时间周六第三、四、五节 (10:15–12:25)
学分3
评分出勤: 10% ; 实验报告: 50% ; 课程汇报: 10% ; 课程项目或论文: 30%

课程资料

课程序号理论课程实验内容
01 (3月7日)第1讲具身智能基础幻灯片 强化学习基础 幻灯片OpenAI Gym入门 实验
02 (3月14日)第2讲状态价值与贝尔曼方程 幻灯片冰冻湖环境 I 实验
03 (3月21日)第3讲贝尔曼最优方程 幻灯片冰冻湖环境 II 实验
04 (3月28日)第4讲价值迭代与策略迭代 幻灯片冰冻湖环境 III 实验
05 (4月4日)放假
06 (4月11日)第5讲蒙特卡洛方法 幻灯片冰冻湖环境 IV 实验
07 (4月18日)第6讲随机近似算法 幻灯片神经网络入门 实验
08 (4月25日)第7讲时序差分方法 幻灯片CarPole环境 实验
09 (5月2日)放假
10 (5月9日)调休
11 (5月16日)第8讲基于价值的方法 幻灯片Atari环境 实验
12 (5月23日)第9讲基于策略的方法 幻灯片 策略梯度推导讲解
13 (5月30日)第10讲Actor-Critic方法幻灯片1、PPO与DPO 幻灯片2REINFORCE Cartpole 环境 实验
14 (6月6日)第11讲机器人学习入门 幻灯片Mujoco环境 DDPG 实验
15 (6月13日)第12讲变分推断与生成式策略 幻灯片Mujoco环境 PPO 实验
16 (6月20日)放假
17 (6月27日)第13讲扩散模型与扩散策略 幻灯片LeRobot机械臂 ACT 实验
18 (7月1日)第14讲通用型机器人策略 幻灯片LeRobot机械臂 DP 实验