Asynchrone methoden voor deep reinforcement learning: Labyrinth
Titel en omschrijving vertaald uit het Engels met AI.
- 14 jun. 2016
- 0 reacties
Maak er iets van
Schrijf je eigen kijk op deze video of zet de discussie open op het forum. De video staat er al in.
Over deze video
De video toont een agent die beloningen verzamelt in doolhoven die hij nog nooit heeft gezien, met alleen ruwe pixels als input. De agent is getraind met het Asynchronous Advantage Actor-Critic-algoritme (A3C) en werd tijdens de training alleen beloond voor het oppakken van appels en oranje portalen. Link naar de paper - http://arxiv.org/pdf/1602.01783.pdf
0 reacties
Nog geen reacties. Wees de eerste!
Log in om te reageren.
Inloggen of word lid