Naar inhoud

The Next Input is in bèta. Iets kapot of een idee? Meld het op het forum · Welkom!

Asynchrone methoden voor deep reinforcement learning: Labyrinth Asynchronous Methods for Deep Reinforcement Learning: Labyrinth

Titel en omschrijving vertaald uit het Engels met AI. Titel en omschrijving zoals de maker ze schreef.

Google DeepMind @googledeepmind
  • 14 jun. 2016
  • 0 reacties

Maak er iets van

Schrijf je eigen kijk op deze video of zet de discussie open op het forum. De video staat er al in.

Over deze video

De video toont een agent die beloningen verzamelt in doolhoven die hij nog nooit heeft gezien, met alleen ruwe pixels als input. De agent is getraind met het Asynchronous Advantage Actor-Critic-algoritme (A3C) en werd tijdens de training alleen beloond voor het oppakken van appels en oranje portalen. Link naar de paper - http://arxiv.org/pdf/1602.01783.pdf

0 reacties

Nog geen reacties. Wees de eerste!

Log in om te reageren.

Inloggen of word lid
Reactie verwijderen?

De tekst verdwijnt. In de draad blijft staan dat hier een reactie is verwijderd, zodat antwoorden erop nog te volgen zijn.