DeepMind x UCL RL Lecture Series - Modelvrije controle [6/13]
Titel en omschrijving vertaald uit het Engels met AI.
- 9 sep. 2021
- 0 reacties
Maak er iets van
Schrijf je eigen kijk op deze video of zet de discussie open op het forum. De video staat er al in.
Over deze video
Research Scientist Hado van Hasselt behandelt voorspellingsalgoritmes voor policy-verbetering, wat leidt tot algoritmes die goede gedragspolicies kunnen leren uit gesamplede ervaring. Slides: https://dpmd.ai/modelfreecontrol Volledige serie videocolleges: https://dpmd.ai/DeepMindxUCL21
0 reacties
Nog geen reacties. Wees de eerste!
Log in om te reageren.
Inloggen of word lid