Aller au contenu

Classement des modèles

Compare les évaluations publiques dans un cadre mono-modèle unifié et affiche le Actu Créaflash score, les rangs de référence et les scores bruts de chaque épreuve.

16 évaluations·7 organismes·10/03 19:23 mise à jour

Classement général30 modèles

Affichage actuel de 30 modèles, réorganisables par colonne ; le rang de référence provient du classement d'origine.
Référence
Rang
modèle
01Claude Opus 5.5Anthropic · 9mois22jourmise en ligne79.6couvre 68%
02Claude Fable 5Anthropic · 6mois9jourmise en ligne79.6couvre 88%
03Claude Fable 5.1Anthropic · 9mois1jourmise en ligne79.6couvre 77%
04Gemini 3.7 FlashGoogle · 8mois13jourmise en ligne77.3couvre 84%
05GPT-6 AstraOpenAI · 9mois3jourmise en ligne77.0couvre 88%
06Gemini 3.8 FlashGoogle · 9mois2jourmise en ligne75.9couvre 88%
07GPT-6.1 SolOpenAI · 9mois29jourmise en ligne75.9couvre 77%
08Claude Opus 5Anthropic · 7mois24jourmise en ligne75.1couvre 81%
09Muse Spark 1.3Meta · 9mois2jourmise en ligne73.8couvre 71%
10GPT-5.6 SolOpenAI · 7mois9jourmise en ligne73.8couvre 88%
11GPT-6 SolOpenAI · 9mois22jourmise en ligne67.1couvre 68%
12Kimi K3Poids open source ↗Moonshot AI · 7mois16jourmise en ligne65.9couvre 75%
13Qwen3.8 MaxAlibaba · 7mois19jourmise en ligne65.6couvre 81%
14Muse Spark 1.2Meta · 8mois5jourmise en ligne65.4couvre 72%
15Gemini 3 Pro PreviewGoogle · 11mois18jourmise en ligne64.6couvre 34%
16GPT-5.5OpenAI · 4mois23jourmise en ligne64.6couvre 88%
17Claude Opus 4.8Anthropic · 5mois28jourmise en ligne63.3couvre 88%
18Gemini 3.6 FlashGoogle · 7mois21jourmise en ligne62.1couvre 84%
19Gemini 3.5 FlashGoogle · 5mois19jourmise en ligne62.1couvre 84%
20Claude Sonnet 5.5Anthropic · 9mois28jourmise en ligne62.1couvre 74%
21Grok 4.6xAI · 8mois12jourmise en ligne60.2couvre 81%
22Grok 4.7xAI · 9mois21jourmise en ligne60.2couvre 71%
23GLM-5.3Poids open source ↗Z.ai · 8mois18jourmise en ligne59.3couvre 75%
24Claude Opus 4.7Anthropic · 4mois16jourmise en ligne58.0couvre 83%
25GPT-5.4OpenAI · 3mois5jourmise en ligne58.0couvre 59%
26GPT-5.6 TerraOpenAI · 7mois9jourmise en ligne57.6couvre 88%
27DeepSeek V4.1 FlashPoids open source ↗DeepSeek · 9mois10jourmise en ligne56.5couvre 49%
28Gemini 3.1 Pro PreviewGoogle · 2mois19jourmise en ligne56.5couvre 88%
29DeepSeek V4 Pro 0813Poids open source ↗DeepSeek · 8mois13jourmise en ligne56.0couvre 65%
30Claude Opus 4.6Anthropic · 2mois5jourmise en ligne55.7couvre 77%

Le classement par catégorie affiche déjà des résultats de tête, mais les preuves globales sont encore insuffisantes :Gemini 4 Argon(déjà 3 évaluations comparables). L'absence de position de référence globale ne signifie pas une capacité moindre : les catégories et les résultats bruts disponibles restent consultables.

Actu Créaflash a une note de 0–100 points ; plus la valeur est élevée, meilleure est la performance globale dans ce classement. À score égal, le tri suit la position de référence ; après filtrage, la note et la position du classement d'origine sont conservées, avec 30 modèles affichés au maximum.

La note sert à comparer au sein d'un même classement et d'une même session ; ce n'est pas un taux de réussite. Les résultats bruts de chaque évaluation sont consultables dans la fiche du modèle.

Comment lire ce classement

Actu Créaflash Plus le score est élevé, plus la performance globale dans ce classement est forte ; le score n'est pas un taux de bonnes réponses ; consultez les scores par épreuve pour le détail des capacités.Le prix n'entre pas dans le tri et les tests manquants ne sont pas compensés. Pour juger des capacités, tenez compte des résultats bruts par sous-test et de la configuration d'exécution.

En savoir plus sur la méthode de calcul →

À propos des prix

API Les prix proviennent du site officiel du fabricant et sont affichés par million de Token.Les tarifs en dollars sont convertis au taux de change du 2026-10-02 en yuans.Le tarif de cache correspond au prix d'entrée en cas de hit de cache ; l'écriture du cache, son stockage et les frais d'abonnement sont facturés séparément.