DeepMind x UCL RL Lecture Series - Policy-gradient- en actor-criticmethoden [9/13]
Titel en omschrijving vertaald uit het Engels met AI.
- 9 sep. 2021
- 0 reacties
Maak er iets van
Schrijf je eigen kijk op deze video of zet de discussie open op het forum. De video staat er al in.
Over deze video
Research Scientist Hado van Hasselt behandelt policy-algoritmes die policies direct kunnen leren, en actor-critic-algoritmes die waardevoorspellingen combineren voor efficiënter leren. Slides: https://dpmd.ai/policygradient Volledige serie videocolleges: https://dpmd.ai/DeepMindxUCL21
0 reacties
Nog geen reacties. Wees de eerste!
Log in om te reageren.
Inloggen of word lid