Asynchrone methoden voor deep reinforcement learning: MuJoCo
Titel en omschrijving vertaald uit het Engels met AI.
- 14 jun. 2016
- 0 reacties
Maak er iets van
Schrijf je eigen kijk op deze video of zet de discussie open op het forum. De video staat er al in.
Over deze video
De video toont agents, getraind met het Asynchronous Advantage Actor-Critic-algoritme (A3C), die uiteenlopende motorische taken uitvoeren. Taken die de agents met succes leerden zijn onder meer een paal omhoog zwaaien, voortbeweging op vier poten, lopen op twee benen in een vlak, balanceren, een doel in 2D bereiken en manipulatie in 3D. Link naar de paper - http://arxiv.org/pdf/1602.01783.pdf
0 reacties
Nog geen reacties. Wees de eerste!
Log in om te reageren.
Inloggen of word lid