Aller au contenu
OpenAI News·· 2018-07-04sélectionAI Score78

OpenAI apprend Montezuma's Revenge à un agent à partir d'une seule démonstration

Learning Montezuma’s Revenge from a single demonstration

AI Introduction

OpenAI a entraîné un agent à atteindre un score élevé de 74 500 sur Montezuma's Revenge à partir d'une seule démonstration humaine.

Raison de la recommandation

L'article explique comment un agent atteint 74 500 points sur Montezuma's Revenge à partir d'une seule démonstration, avec un algorithme simple fondé sur PPO.

Source :OpenAI News · openai.com