Что разбирают и где
Тайм-коды записи, разобранные по темам атласа: под главой стоят темы, которые в ней названы, — из лекции можно уйти в текстовый разбор и вернуться.
Нажатие на тайм-код перематывает запись, не перезагружая страницу. Открыть на YouTube ↗
- Model-Based RL
- Model-Based RL
- Policy Gradient
- Dynamic ProgrammingModel-Based RL
- Dynamic ProgrammingModel-Based RL
- Planning and World Models
- Planning and World Models
- Planning and World Models
- BackpropagationPlanning and World Models
- Multi-armed Bandits
- Backpropagation
- Policy Gradient
- Planning and World Models
- Planning and World Models
- Planning and World ModelsMLP
- Planning and World Models
- Loss functionsPlanning and World Models
- Value Functions
- Planning and World Models
- Planning and World Models
- On-policy and Off-policyPolicy Gradient
- Model-Based RLPlanning and World Models
- Planning and World Models
- Planning and World Models
- Planning and World Models
- Planning and World Models
- Planning and World Models
- Multi-armed Bandits
- Backpropagation
- Exploration in RLPlanning and World Models
- Planning and World Models
- Planning and World Models