Aller au contenu
OpenAI News·· 2019-09-19sélectionAI Score62

OpenAI ajuste GPT-2 774M par les préférences humaines

Fine-tuning GPT-2 from human preferences

AI Introduction

OpenAI a ajusté le modèle de langage GPT-2 de 774M paramètres à l'aide de retours humains pour diverses tâches。

Raison de la recommandation

L'original expose les préférences humaines et le nombre d'annotations nécessaires pour différentes tâches, ce qui permet de comprendre le coût et les limites du fine-tuning par retour humain.

Source :OpenAI News · openai.com