OpenAI News·· 2018-04-18AI Score22
OpenAI publie Evolved Policy Gradients, une approche de méta-apprentissage par évolution de la fonction de perte
Evolved Policy Gradients
AI Introduction
OpenAI publie Evolved Policy Gradients (EPG), une approche expérimentale de méta-apprentissage qui fait évoluer la fonction de perte des agents d'apprentissage afin de permettre un entraînement rapide sur de nouvelles tâches. Les agents entraînés avec EPG réussissent à l'évaluation des tâches de base hors de leur régime d'entraînement, comme apprendre à naviguer vers un objet situé du côté opposé de la pièce par rapport à sa position pendant l'entraînement.
Source :OpenAI News · openai.com