OpenAI News·· 2018-07-04sélectionAI Score78
OpenAI apprend Montezuma's Revenge à un agent à partir d'une seule démonstration
Learning Montezuma’s Revenge from a single demonstration
AI Introduction
OpenAI a entraîné un agent à atteindre un score élevé de 74 500 sur Montezuma's Revenge à partir d'une seule démonstration humaine.
Raison de la recommandation
L'article explique comment un agent atteint 74 500 points sur Montezuma's Revenge à partir d'une seule démonstration, avec un algorithme simple fondé sur PPO.
Source :OpenAI News · openai.com