DeepMind x UCL RL Lecture Series - Multi-step en off-policy [11/13]
Titel en omschrijving vertaald uit het Engels met AI.
- 9 sep. 2021
- 0 reacties
Maak er iets van
Schrijf je eigen kijk op deze video of zet de discussie open op het forum. De video staat er al in.
Over deze video
Research Scientist Hado van Hasselt bespreekt multi-step- en off-policy-algoritmes, inclusief verschillende technieken om de variantie te verlagen. Slides: https://dpmd.ai/offpolicy Volledige serie videocolleges: https://dpmd.ai/DeepMindxUCL21
0 reacties
Nog geen reacties. Wees de eerste!
Log in om te reageren.
Inloggen of word lid