Aller au contenu

Classement des modèles

De l'écriture de code à la modification de dépôts, pour voir si un modèle peut produire un logiciel.

2 évaluations·2 organismes·10/03 20:40 mise à jour

programmationclassement28 modèles

Affichage actuel de 28 modèles, réorganisables par colonne ; le rang de référence provient du classement d'origine.
Référence
Rang
modèle
01Claude Fable 5Anthropic · 6mois9jourmise en ligne79.0couvre 100%
02Claude Opus 5Anthropic · 7mois24jourmise en ligne77.1couvre 100%
03GPT-5.6 SolOpenAI · 7mois9jourmise en ligne73.4couvre 100%
04Kimi K3Poids open source ↗Moonshot AI · 7mois16jourmise en ligne72.2couvre 100%
05GPT-6 AstraOpenAI · 9mois3jourmise en ligne68.8couvre 100%
06GLM-5.3Poids open source ↗Z.ai · 8mois18jourmise en ligne66.8couvre 100%
07GPT-5.5OpenAI · 4mois23jourmise en ligne64.3couvre 100%
08Gemini 3.7 FlashGoogle · 8mois13jourmise en ligne61.1couvre 100%
09GPT-5.6 LunaOpenAI · 7mois9jourmise en ligne59.4couvre 100%
10GPT-5.6 TerraOpenAI · 7mois9jourmise en ligne59.4couvre 100%
11GLM-5.3 FlashPoids open source ↗Z.ai · 8mois26jourmise en ligne58.0couvre 100%
12Grok 4.6xAI · 8mois12jourmise en ligne56.4couvre 100%
13Claude Sonnet 5Anthropic · 6mois30jourmise en ligne56.2couvre 100%
14Gemini 3.8 FlashGoogle · 9mois2jourmise en ligne50.8couvre 100%
15Claude Opus 4.8Anthropic · 5mois28jourmise en ligne50.8couvre 100%
16Qwen3.8 MaxAlibaba · 7mois19jourmise en ligne47.7couvre 100%
17Muse Spark 1.2Meta · 8mois5jourmise en ligne47.7couvre 100%
18Muse Spark 1.1Meta · 7mois9jourmise en ligne47.0couvre 100%
19GPT-5.4OpenAI · 3mois5jourmise en ligne41.2couvre 100%
20GLM-5.2Poids open source ↗Z.ai · 6mois16jourmise en ligne39.0couvre 100%
21Grok 4.5xAI · 7mois8jourmise en ligne32.1couvre 100%
22Gemini 3.6 FlashGoogle · 7mois21jourmise en ligne29.2couvre 100%
23Gemini 3.5 FlashGoogle · 5mois19jourmise en ligne29.2couvre 100%
24Claude Sonnet 4.6Anthropic · 2mois17jourmise en ligne26.0couvre 100%
25DeepSeek V4 Pro PreviewPoids open source ↗DeepSeek · 4mois24jourmise en ligne26.0couvre 100%
26Kimi K2.7 CodePoids open source ↗Moonshot AI · 6mois12jourmise en ligne19.9couvre 100%
27Gemini 3.1 Pro PreviewGoogle · 2mois19jourmise en ligne19.9couvre 100%
28DeepSeek V4 Flash PreviewPoids open source ↗DeepSeek · 4mois24jourmise en ligne18.3couvre 100%

Parmi les dix premiers du classement général de référence, pas encore auprogrammationclassement :Claude Opus 5.5(déjà 1 évaluations comparables), Claude Fable 5.1(déjà 1 évaluations comparables), GPT-6.1 Sol(déjà 1 évaluations comparables), Muse Spark 1.3(déjà 1 évaluations comparables). Le classement par catégorie ne compare que les modèles ayant passé des évaluations du même type ; il faut généralement deux évaluations issues de deux organismes.

Actu Créaflash a une note de 0–100 points ; plus la valeur est élevée, meilleure est la performance globale dans ce classement. À score égal, le tri suit la position de référence ; après filtrage, la note et la position du classement d'origine sont conservées, avec 30 modèles affichés au maximum.

La note sert à comparer au sein d'un même classement et d'une même session ; ce n'est pas un taux de réussite. Les résultats bruts de chaque évaluation sont consultables dans la fiche du modèle.

Comment lire ce classement

Actu Créaflash Plus le score est élevé, plus la performance globale dans ce classement est forte ; le score n'est pas un taux de bonnes réponses ; consultez les scores par épreuve pour le détail des capacités.Le prix n'entre pas dans le tri et les tests manquants ne sont pas compensés. Pour juger des capacités, tenez compte des résultats bruts par sous-test et de la configuration d'exécution.

En savoir plus sur la méthode de calcul →

À propos des prix

API Les prix proviennent du site officiel du fabricant et sont affichés par million de Token.Les tarifs en dollars sont convertis au taux de change du 2026-10-02 en yuans.Le tarif de cache correspond au prix d'entrée en cas de hit de cache ; l'écriture du cache, son stockage et les frais d'abonnement sont facturés séparément.