Classement des modèles
AI Classement des modèles
Compare les évaluations publiques dans un cadre mono-modèle unifié et affiche le Actu Créaflash score, les rangs de référence et les scores bruts de chaque épreuve.
16 évaluations·7 organismes·10/03 19:23 mise à jour
Classement général30 modèles
| Référence Rang | modèle | ||
|---|---|---|---|
| 01 | Claude Opus 5.5AnthropicAnthropic · 9mois22jourmise en ligne | 13 évaluationscouvre 68% | 79.6couvre 68% |
| 02 | Claude Fable 5AnthropicAnthropic · 6mois9jourmise en ligne | 16 évaluationscouvre 88% | 79.6couvre 88% |
| 03 | Claude Fable 5.1AnthropicAnthropic · 9mois1jourmise en ligne | 14 évaluationscouvre 77% | 79.6couvre 77% |
| 04 | Gemini 3.7 FlashGoogleGoogle · 8mois13jourmise en ligne | 15 évaluationscouvre 84% | 77.3couvre 84% |
| 05 | GPT-6 AstraOpenAIOpenAI · 9mois3jourmise en ligne | 16 évaluationscouvre 88% | 77.0couvre 88% |
| 06 | Gemini 3.8 FlashGoogleGoogle · 9mois2jourmise en ligne | 16 évaluationscouvre 88% | 75.9couvre 88% |
| 07 | GPT-6.1 SolOpenAIOpenAI · 9mois29jourmise en ligne | 13 évaluationscouvre 77% | 75.9couvre 77% |
| 08 | Claude Opus 5AnthropicAnthropic · 7mois24jourmise en ligne | 15 évaluationscouvre 81% | 75.1couvre 81% |
| 09 | Muse Spark 1.3MetaMeta · 9mois2jourmise en ligne | 13 évaluationscouvre 71% | 73.8couvre 71% |
| 10 | GPT-5.6 SolOpenAIOpenAI · 7mois9jourmise en ligne | 16 évaluationscouvre 88% | 73.8couvre 88% |
| 11 | GPT-6 SolOpenAIOpenAI · 9mois22jourmise en ligne | 13 évaluationscouvre 68% | 67.1couvre 68% |
| 12 | Kimi K3Poids open source ↗Moonshot AIMoonshot AI · 7mois16jourmise en ligne | 15 évaluationscouvre 75% | 65.9couvre 75% |
| 13 | Qwen3.8 MaxAlibabaAlibaba · 7mois19jourmise en ligne | 14 évaluationscouvre 81% | 65.6couvre 81% |
| 14 | Muse Spark 1.2MetaMeta · 8mois5jourmise en ligne | 11 évaluationscouvre 72% | 65.4couvre 72% |
| 15 | Gemini 3 Pro PreviewGoogleGoogle · 11mois18jourmise en ligne | 6 évaluationscouvre 34% | 64.6couvre 34% |
| 16 | GPT-5.5OpenAIOpenAI · 4mois23jourmise en ligne | 16 évaluationscouvre 88% | 64.6couvre 88% |
| 17 | Claude Opus 4.8AnthropicAnthropic · 5mois28jourmise en ligne | 16 évaluationscouvre 88% | 63.3couvre 88% |
| 18 | Gemini 3.6 FlashGoogleGoogle · 7mois21jourmise en ligne | 15 évaluationscouvre 84% | 62.1couvre 84% |
| 19 | Gemini 3.5 FlashGoogleGoogle · 5mois19jourmise en ligne | 15 évaluationscouvre 84% | 62.1couvre 84% |
| 20 | Claude Sonnet 5.5AnthropicAnthropic · 9mois28jourmise en ligne | 12 évaluationscouvre 74% | 62.1couvre 74% |
| 21 | Grok 4.6xAIxAI · 8mois12jourmise en ligne | 14 évaluationscouvre 81% | 60.2couvre 81% |
| 22 | Grok 4.7xAIxAI · 9mois21jourmise en ligne | 14 évaluationscouvre 71% | 60.2couvre 71% |
| 23 | GLM-5.3Poids open source ↗Z.aiZ.ai · 8mois18jourmise en ligne | 15 évaluationscouvre 75% | 59.3couvre 75% |
| 24 | Claude Opus 4.7AnthropicAnthropic · 4mois16jourmise en ligne | 15 évaluationscouvre 83% | 58.0couvre 83% |
| 25 | GPT-5.4OpenAIOpenAI · 3mois5jourmise en ligne | 9 évaluationscouvre 59% | 58.0couvre 59% |
| 26 | GPT-5.6 TerraOpenAIOpenAI · 7mois9jourmise en ligne | 16 évaluationscouvre 88% | 57.6couvre 88% |
| 27 | DeepSeek V4.1 FlashPoids open source ↗DeepSeekDeepSeek · 9mois10jourmise en ligne | 8 évaluationscouvre 49% | 56.5couvre 49% |
| 28 | Gemini 3.1 Pro PreviewGoogleGoogle · 2mois19jourmise en ligne | 16 évaluationscouvre 88% | 56.5couvre 88% |
| 29 | DeepSeek V4 Pro 0813Poids open source ↗DeepSeekDeepSeek · 8mois13jourmise en ligne | 12 évaluationscouvre 65% | 56.0couvre 65% |
| 30 | Claude Opus 4.6AnthropicAnthropic · 2mois5jourmise en ligne | 14 évaluationscouvre 77% | 55.7couvre 77% |
Le classement par catégorie affiche déjà des résultats de tête, mais les preuves globales sont encore insuffisantes :Gemini 4 Argon(déjà 3 évaluations comparables). L'absence de position de référence globale ne signifie pas une capacité moindre : les catégories et les résultats bruts disponibles restent consultables.
Actu Créaflash a une note de 0–100 points ; plus la valeur est élevée, meilleure est la performance globale dans ce classement. À score égal, le tri suit la position de référence ; après filtrage, la note et la position du classement d'origine sont conservées, avec 30 modèles affichés au maximum.
La note sert à comparer au sein d'un même classement et d'une même session ; ce n'est pas un taux de réussite. Les résultats bruts de chaque évaluation sont consultables dans la fiche du modèle.
Comment lire ce classement
Actu Créaflash Plus le score est élevé, plus la performance globale dans ce classement est forte ; le score n'est pas un taux de bonnes réponses ; consultez les scores par épreuve pour le détail des capacités.Le prix n'entre pas dans le tri et les tests manquants ne sont pas compensés. Pour juger des capacités, tenez compte des résultats bruts par sous-test et de la configuration d'exécution.
En savoir plus sur la méthode de calcul →À propos des prix
API Les prix proviennent du site officiel du fabricant et sont affichés par million de Token.Les tarifs en dollars sont convertis au taux de change du 2026-10-02 en yuans.Le tarif de cache correspond au prix d'entrée en cas de hit de cache ; l'écriture du cache, son stockage et les frais d'abonnement sont facturés séparément.