OpenAI News·· 2019-09-19sélectionAI Score62
OpenAI ajuste GPT-2 774M par les préférences humaines
Fine-tuning GPT-2 from human preferences
AI Introduction
OpenAI a ajusté le modèle de langage GPT-2 de 774M paramètres à l'aide de retours humains pour diverses tâches。
Raison de la recommandation
L'original expose les préférences humaines et le nombre d'annotations nécessaires pour différentes tâches, ce qui permet de comprendre le coût et les limites du fine-tuning par retour humain.
Source :OpenAI News · openai.com