Aller au contenu
OpenAI News·· 2025-12-03AI Score42

OpenAI teste les « confessions » pour rendre les modèles de langage plus honnêtes

How confessions can keep language models honest

AI Introduction

Les chercheurs d'OpenAI testent les « confessions », une méthode qui entraîne les modèles à admettre leurs erreurs ou comportements indésirables afin d'améliorer l'honnêteté.

Source :OpenAI News · openai.com