Reinforcement learning met voorspellingsgebaseerde beloningen
Titel en omschrijving vertaald uit het Engels met AI.
- 31 okt. 2018
- 0 reacties
Maak er iets van
Schrijf je eigen kijk op deze video of zet de discussie open op het forum. De video staat er al in.
Over deze video
We hebben Random Network Distillation (RND) ontwikkeld, een voorspellingsgebaseerde methode die reinforcement learning-agents aanmoedigt om hun omgeving uit nieuwsgierigheid te verkennen, en die voor het eerst de gemiddelde menselijke prestatie op Montezuma’s Revenge overtreft. Meer weten: https://blog.openai.com/reinforcement-learning-with-prediction-based-rewards/
0 reacties
Nog geen reacties. Wees de eerste!
Log in om te reageren.
Inloggen of word lid