OpenAI News·· 2017-08-03AI Score52
OpenAI publie RL-Teacher, une implémentation open source pour entraîner les IA via des retours humains
Gathering human feedback
AI Introduction
OpenAI a publié RL-Teacher, une implémentation open source de son interface permettant d'entraîner des IA via des retours humains occasionnels plutôt que des fonctions de récompense écrites à la main. La technique sous-jacente a été développée comme une étape vers des systèmes d'IA sûrs, et s'applique aussi aux problèmes d'apprentissage par renforcement dont les récompenses sont difficiles à spécifier.
Source :OpenAI News · openai.com