Aller au contenu
OpenAI News·· 2024-10-30AI Score26

OpenAI présente SimpleQA, un benchmark de factualité pour les modèles de langage

Introducing SimpleQA

AI Introduction

OpenAI introduit SimpleQA, un benchmark de factualité qui évalue la capacité des modèles de langage à répondre à des questions courtes et factuelles. Le benchmark cible les questions à réponse factuelle brève, mesurant ainsi la fiabilité factuelle des LLM.

Source :OpenAI News · openai.com