Asynchrone methoden voor deep reinforcement learning: TORCS
Titel en omschrijving vertaald uit het Engels met AI.
- 14 jun. 2016
- 0 reacties
Maak er iets van
Schrijf je eigen kijk op deze video of zet de discussie open op het forum. De video staat er al in.
Over deze video
De video toont een agent die een raceauto bestuurt met alleen ruwe pixels als input. De agent is getraind met het Asynchronous Advantage Actor-Critic-algoritme (A3C). Tijdens de training werd de agent beloond voor het aanhouden van een hoge snelheid over het midden van het circuit. Link naar de paper - http://arxiv.org/pdf/1602.01783.pdf
0 reacties
Nog geen reacties. Wees de eerste!
Log in om te reageren.
Inloggen of word lid