Aller au contenu
MIT Technology Review · AI· Arthur Holland Michel·· 3 hAI Score22

MIT Technology Review : nous faisons trop confiance à la capacité de l'IA à dire non

We’re putting too much faith in AI’s ability to say no

AI Introduction

Le refus est devenu le « mur porteur » de la sécurité des IA, mais il reste probabiliste et donc peu fiable. Anthropic prônait dès 2021 des LLM helpful.

Source :MIT Technology Review · AI · technologyreview.com