Обучение с подкреплением

Введение в Reinforcement Learning

Лекция3 ч 19 мин · запись 10.01.2026

Что разбирают и где

Тайм-коды записи, разобранные по темам атласа: под главой стоят темы, которые в ней названы, — из лекции можно уйти в текстовый разбор и вернуться.

Нажатие на тайм-код перематывает запись, не перезагружая страницу. Открыть на YouTube ↗

  1. MDP
  2. Model-Based RL
  3. MDP
  4. Reward Design
  5. Reward Design
  6. Reward Design
  7. Discounting and Horizon
  8. Discounting and Horizon
  9. MDP
  10. Policy Gradient
  11. MDP
  12. MDP
  13. Value Functions
  14. Value Functions
  15. Value Functions
  16. Value Functions
  17. Value Functions
  18. Value Functions
  19. Value Functions
  20. Value FunctionsPolicy Gradient
  21. Value Functions
  22. Value Functions
  23. Value Functions
  24. Exploration in RLMDP
  25. Value Functions
  26. Reward Design
  27. Cross-Entropy
  28. Cross-Entropy
  29. Random Search
  30. Model-Based RL