Classement des modèles
AI Classement des modèles
Questions factuelles et connaissances scientifiques de niveau master : voir la maîtrise des connaissances et l'exactitude des réponses.
2 évaluations·1 organismes·10/03 20:40 mise à jour
Connaissanceclassement30 modèles
| Référence Rang | modèle | ||
|---|---|---|---|
| 01 | GPT-6 AstraOpenAIOpenAI · 9mois3jourmise en ligne | 2 évaluationscouvre 100% | 82.7couvre 100% |
| 02 | GPT-6.1 SolOpenAIOpenAI · 9mois29jourmise en ligne | 2 évaluationscouvre 100% | 81.9couvre 100% |
| 03 | Gemini 3.8 FlashGoogleGoogle · 9mois2jourmise en ligne | 2 évaluationscouvre 100% | 80.9couvre 100% |
| 04 | Gemini 3.1 Pro PreviewGoogleGoogle · 2mois19jourmise en ligne | 2 évaluationscouvre 100% | 80.2couvre 100% |
| 05 | Gemini 3.7 FlashGoogleGoogle · 8mois13jourmise en ligne | 2 évaluationscouvre 100% | 79.8couvre 100% |
| 06 | GPT-5.6 SolOpenAIOpenAI · 7mois9jourmise en ligne | 2 évaluationscouvre 100% | 77.2couvre 100% |
| 07 | Gemini 3.6 FlashGoogleGoogle · 7mois21jourmise en ligne | 2 évaluationscouvre 100% | 77.2couvre 100% |
| 08 | GPT-6 SolOpenAIOpenAI · 9mois22jourmise en ligne | 2 évaluationscouvre 100% | 74.8couvre 100% |
| 09 | Gemini 3.5 FlashGoogleGoogle · 5mois19jourmise en ligne | 2 évaluationscouvre 100% | 73.9couvre 100% |
| 10 | Claude Opus 5AnthropicAnthropic · 7mois24jourmise en ligne | 2 évaluationscouvre 100% | 73.2couvre 100% |
| 11 | Claude Opus 5.5AnthropicAnthropic · 9mois22jourmise en ligne | 2 évaluationscouvre 100% | 69.2couvre 100% |
| 12 | Claude Sonnet 5.5AnthropicAnthropic · 9mois28jourmise en ligne | 2 évaluationscouvre 100% | 67.1couvre 100% |
| 13 | Grok 4.7xAIxAI · 9mois21jourmise en ligne | 2 évaluationscouvre 100% | 67.1couvre 100% |
| 14 | GPT-5.4 Pro 2026-03-05OpenAIOpenAI · 3mois5jourmise en ligne | 2 évaluationscouvre 100% | 64.7couvre 100% |
| 15 | GPT-5.5OpenAIOpenAI · 4mois23jourmise en ligne | 2 évaluationscouvre 100% | 64.7couvre 100% |
| 16 | Kimi K3Poids open source ↗Moonshot AIMoonshot AI · 7mois16jourmise en ligne | 2 évaluationscouvre 100% | 63.9couvre 100% |
| 17 | Grok 4.5xAIxAI · 7mois8jourmise en ligne | 2 évaluationscouvre 100% | 62.8couvre 100% |
| 18 | Grok 4.6xAIxAI · 8mois12jourmise en ligne | 2 évaluationscouvre 100% | 62.6couvre 100% |
| 19 | Gemini 3 Flash PreviewGoogleGoogle · 12mois17jourmise en ligne | 2 évaluationscouvre 100% | 62.6couvre 100% |
| 20 | GPT-5.4 2026-03-05OpenAIOpenAI · 3mois5jourmise en ligne | 2 évaluationscouvre 100% | 60.2couvre 100% |
| 21 | DeepSeek V4 Pro 0813Poids open source ↗DeepSeekDeepSeek · 8mois13jourmise en ligne | 2 évaluationscouvre 100% | 60.2couvre 100% |
| 22 | Qwen3.7 MaxAlibabaAlibaba · 5mois19jourmise en ligne | 2 évaluationscouvre 100% | 60.2couvre 100% |
| 23 | GPT-5.6 TerraOpenAIOpenAI · 7mois9jourmise en ligne | 2 évaluationscouvre 100% | 58.0couvre 100% |
| 24 | Qwen3.8 MaxAlibabaAlibaba · 7mois19jourmise en ligne | 2 évaluationscouvre 100% | 58.0couvre 100% |
| 25 | Qwen3.8 Max 0902AlibabaAlibaba · 9mois1jourmise en ligne | 2 évaluationscouvre 100% | 58.0couvre 100% |
| 26 | Claude Opus 4.8AnthropicAnthropic · 5mois28jourmise en ligne | 2 évaluationscouvre 100% | 58.0couvre 100% |
| 27 | Claude Fable 5AnthropicAnthropic · 6mois9jourmise en ligne | 2 évaluationscouvre 100% | 55.1couvre 100% |
| 28 | GPT-5.6 LunaOpenAIOpenAI · 7mois9jourmise en ligne | 2 évaluationscouvre 100% | 49.4couvre 100% |
| 29 | GLM-5.3Poids open source ↗Z.aiZ.ai · 8mois18jourmise en ligne | 2 évaluationscouvre 100% | 46.9couvre 100% |
| 30 | DeepSeek V4 Pro PreviewPoids open source ↗DeepSeekDeepSeek · 4mois24jourmise en ligne | 2 évaluationscouvre 100% | 46.9couvre 100% |
Parmi les dix premiers du classement général de référence, pas encore auConnaissanceclassement :Claude Fable 5.1(déjà 1 évaluations comparables), Muse Spark 1.3(déjà 0 évaluations comparables). Le classement par catégorie ne compare que les modèles ayant passé des évaluations du même type ; il faut généralement deux évaluations issues de deux organismes.
Actu Créaflash a une note de 0–100 points ; plus la valeur est élevée, meilleure est la performance globale dans ce classement. À score égal, le tri suit la position de référence ; après filtrage, la note et la position du classement d'origine sont conservées, avec 30 modèles affichés au maximum.
La note sert à comparer au sein d'un même classement et d'une même session ; ce n'est pas un taux de réussite. Les résultats bruts de chaque évaluation sont consultables dans la fiche du modèle.
Comment lire ce classement
Le classement des connaissances actuel repose sur deux évaluations d'Epoch, issues de la même organisation.Le prix n'entre pas dans le tri et les tests manquants ne sont pas compensés. Pour juger des capacités, tenez compte des résultats bruts par sous-test et de la configuration d'exécution.
En savoir plus sur la méthode de calcul →À propos des prix
API Les prix proviennent du site officiel du fabricant et sont affichés par million de Token.Les tarifs en dollars sont convertis au taux de change du 2026-10-02 en yuans.Le tarif de cache correspond au prix d'entrée en cas de hit de cache ; l'écriture du cache, son stockage et les frais d'abonnement sont facturés séparément.