Aller au contenu
OpenAI News·· 2017-08-03AI Score52

OpenAI publie RL-Teacher, une implémentation open source pour entraîner les IA via des retours humains

Gathering human feedback

AI Introduction

OpenAI a publié RL-Teacher, une implémentation open source de son interface permettant d'entraîner des IA via des retours humains occasionnels plutôt que des fonctions de récompense écrites à la main. La technique sous-jacente a été développée comme une étape vers des systèmes d'IA sûrs, et s'applique aussi aux problèmes d'apprentissage par renforcement dont les récompenses sont difficiles à spécifier.

Source :OpenAI News · openai.com