SMS 00103335: Deep Learning and Reinforcement Learning
Fall 2026, Peking University
Info
Time: x.
Office hour: x.
Location: x.
Midterm Exam: Nov 2, 2026.
Final Exam: x.
Grading: Homework 30%, midterm exam 30%, final exam 40%.
Course Description
Reference
Markov Decision Processes and Reinforcement Learning, Martin L. Puterman and Timothy C. Y. Chan.
Convex Optimization: Algorithms and Complexity, Sébastien Bubeck
TBD
Lectures
Assignment
|