Aller au contenu
OpenAI News·· 2018-04-18AI Score22

OpenAI publie Evolved Policy Gradients, une approche de méta-apprentissage par évolution de la fonction de perte

Evolved Policy Gradients

AI Introduction

OpenAI publie Evolved Policy Gradients (EPG), une approche expérimentale de méta-apprentissage qui fait évoluer la fonction de perte des agents d'apprentissage afin de permettre un entraînement rapide sur de nouvelles tâches. Les agents entraînés avec EPG réussissent à l'évaluation des tâches de base hors de leur régime d'entraînement, comme apprendre à naviguer vers un objet situé du côté opposé de la pièce par rapport à sa position pendant l'entraînement.

Source :OpenAI News · openai.com