SMS 00103335: Deep Learning and Reinforcement Learning


Fall 2026, Peking University

Info

Time: x.
Office hour: x.
Location: x.
Midterm Exam: Nov 2, 2026.
Final Exam: x.
Grading: Homework 30%, midterm exam 30%, final exam 40%.

Course Description

  • x

Reference

  • Markov Decision Processes and Reinforcement Learning, Martin L. Puterman and Timothy C. Y. Chan.

  • Convex Optimization: Algorithms and Complexity, Sébastien Bubeck

  • TBD

Lectures

  • x

  • Invited Lecture: Nov 4, 2026.

Assignment

  • x