OpenAI News·· 2025-12-03AI Score42
OpenAI teste les « confessions » pour rendre les modèles de langage plus honnêtes
How confessions can keep language models honest
AI Introduction
Les chercheurs d'OpenAI testent les « confessions », une méthode qui entraîne les modèles à admettre leurs erreurs ou comportements indésirables afin d'améliorer l'honnêteté.
Source :OpenAI News · openai.com