OpenAI News·· 2024-10-30AI Score26
OpenAI présente SimpleQA, un benchmark de factualité pour les modèles de langage
Introducing SimpleQA
AI Introduction
OpenAI introduit SimpleQA, un benchmark de factualité qui évalue la capacité des modèles de langage à répondre à des questions courtes et factuelles. Le benchmark cible les questions à réponse factuelle brève, mesurant ainsi la fiabilité factuelle des LLM.
Source :OpenAI News · openai.com