Обучение с подкреплением

Offline Reinforcement Learning

Лекция2 ч 50 мин · запись 21.02.2026

Что разбирают и где

Тайм-коды записи, разобранные по темам атласа: под главой стоят темы, которые в ней названы, — из лекции можно уйти в текстовый разбор и вернуться.

Нажатие на тайм-код перематывает запись, не перезагружая страницу. Открыть на YouTube ↗

  1. Offline RL
  2. On-policy and Off-policy
  3. Offline RL
  4. Offline RL
  5. Offline RLReward Design
  6. Offline RL
  7. Offline RL
  8. Actor-Critic
  9. DQNQ-Learning
  10. Offline RL
  11. KL Divergence
  12. Q-Learning
  13. Q-LearningOffline RL
  14. Offline RL
  15. Transformers
  16. RegularizationActor-Critic
  17. Stacking and Blending
  18. Offline RL
  19. Actor-Critic
  20. Policy Gradient
  21. Experience Replay