Aller au contenu

Classement des modèles

Questions factuelles et connaissances scientifiques de niveau master : voir la maîtrise des connaissances et l'exactitude des réponses.

2 évaluations·1 organismes·10/03 20:40 mise à jour

Connaissanceclassement30 modèles

Affichage actuel de 30 modèles, réorganisables par colonne ; le rang de référence provient du classement d'origine.
Référence
Rang
modèle
01GPT-6 AstraOpenAI · 9mois3jourmise en ligne82.7couvre 100%
02GPT-6.1 SolOpenAI · 9mois29jourmise en ligne81.9couvre 100%
03Gemini 3.8 FlashGoogle · 9mois2jourmise en ligne80.9couvre 100%
04Gemini 3.1 Pro PreviewGoogle · 2mois19jourmise en ligne80.2couvre 100%
05Gemini 3.7 FlashGoogle · 8mois13jourmise en ligne79.8couvre 100%
06GPT-5.6 SolOpenAI · 7mois9jourmise en ligne77.2couvre 100%
07Gemini 3.6 FlashGoogle · 7mois21jourmise en ligne77.2couvre 100%
08GPT-6 SolOpenAI · 9mois22jourmise en ligne74.8couvre 100%
09Gemini 3.5 FlashGoogle · 5mois19jourmise en ligne73.9couvre 100%
10Claude Opus 5Anthropic · 7mois24jourmise en ligne73.2couvre 100%
11Claude Opus 5.5Anthropic · 9mois22jourmise en ligne69.2couvre 100%
12Claude Sonnet 5.5Anthropic · 9mois28jourmise en ligne67.1couvre 100%
13Grok 4.7xAI · 9mois21jourmise en ligne67.1couvre 100%
14GPT-5.4 Pro 2026-03-05OpenAI · 3mois5jourmise en ligne64.7couvre 100%
15GPT-5.5OpenAI · 4mois23jourmise en ligne64.7couvre 100%
16Kimi K3Poids open source ↗Moonshot AI · 7mois16jourmise en ligne63.9couvre 100%
17Grok 4.5xAI · 7mois8jourmise en ligne62.8couvre 100%
18Grok 4.6xAI · 8mois12jourmise en ligne62.6couvre 100%
19Gemini 3 Flash PreviewGoogle · 12mois17jourmise en ligne62.6couvre 100%
20GPT-5.4 2026-03-05OpenAI · 3mois5jourmise en ligne60.2couvre 100%
21DeepSeek V4 Pro 0813Poids open source ↗DeepSeek · 8mois13jourmise en ligne60.2couvre 100%
22Qwen3.7 MaxAlibaba · 5mois19jourmise en ligne60.2couvre 100%
23GPT-5.6 TerraOpenAI · 7mois9jourmise en ligne58.0couvre 100%
24Qwen3.8 MaxAlibaba · 7mois19jourmise en ligne58.0couvre 100%
25Qwen3.8 Max 0902Alibaba · 9mois1jourmise en ligne58.0couvre 100%
26Claude Opus 4.8Anthropic · 5mois28jourmise en ligne58.0couvre 100%
27Claude Fable 5Anthropic · 6mois9jourmise en ligne55.1couvre 100%
28GPT-5.6 LunaOpenAI · 7mois9jourmise en ligne49.4couvre 100%
29GLM-5.3Poids open source ↗Z.ai · 8mois18jourmise en ligne46.9couvre 100%
30DeepSeek V4 Pro PreviewPoids open source ↗DeepSeek · 4mois24jourmise en ligne46.9couvre 100%

Parmi les dix premiers du classement général de référence, pas encore auConnaissanceclassement :Claude Fable 5.1(déjà 1 évaluations comparables), Muse Spark 1.3(déjà 0 évaluations comparables). Le classement par catégorie ne compare que les modèles ayant passé des évaluations du même type ; il faut généralement deux évaluations issues de deux organismes.

Actu Créaflash a une note de 0–100 points ; plus la valeur est élevée, meilleure est la performance globale dans ce classement. À score égal, le tri suit la position de référence ; après filtrage, la note et la position du classement d'origine sont conservées, avec 30 modèles affichés au maximum.

La note sert à comparer au sein d'un même classement et d'une même session ; ce n'est pas un taux de réussite. Les résultats bruts de chaque évaluation sont consultables dans la fiche du modèle.

Comment lire ce classement

Le classement des connaissances actuel repose sur deux évaluations d'Epoch, issues de la même organisation.Le prix n'entre pas dans le tri et les tests manquants ne sont pas compensés. Pour juger des capacités, tenez compte des résultats bruts par sous-test et de la configuration d'exécution.

En savoir plus sur la méthode de calcul →

À propos des prix

API Les prix proviennent du site officiel du fabricant et sont affichés par million de Token.Les tarifs en dollars sont convertis au taux de change du 2026-10-02 en yuans.Le tarif de cache correspond au prix d'entrée en cas de hit de cache ; l'écriture du cache, son stockage et les frais d'abonnement sont facturés séparément.