Что разбирают и где
Тайм-коды записи, разобранные по темам атласа: под главой стоят темы, которые в ней названы, — из лекции можно уйти в текстовый разбор и вернуться.
Нажатие на тайм-код перематывает запись, не перезагружая страницу. Открыть на YouTube ↗
- MDP
- Model-Based RL
- MDP
- Reward Design
- Reward Design
- Reward Design
- Discounting and Horizon
- Discounting and Horizon
- MDP
- Policy Gradient
- MDP
- MDP
- Value Functions
- Value Functions
- Value Functions
- Value Functions
- Value Functions
- Value Functions
- Value Functions
- Value FunctionsPolicy Gradient
- Value Functions
- Value Functions
- Value Functions
- Exploration in RLMDP
- Value Functions
- Reward Design
- Cross-Entropy
- Cross-Entropy
- Random Search
- Model-Based RL