Aller au contenu

MirrorCode

Epoch AI / programmation · Reproduction logicielle de longue durée

Évaluation officielle
dans le Actu Créaflash surÀ titre indicatif
Budget de preuvesHors classement
Date des données amont09/23 00:42
Dernière synchronisation réussie10/03 20:40

Ce qu'il mesure, comment il le mesure

Les données publiées ne couvrent que quelques modèles et les temps d'exécution sont très longs ; l'échantillon et les conditions d'exécution ne suffisent pas à former un consensus de catégorie.

Comment utiliser ces preuves

Uniquement à titre indicatif, sans entrée dans les scores globaux ou de catégorie.

Scores d'évaluation

Selon des règles fixes, chaque modèle public utilise une configuration représentative ; les modèles sans configuration admissible sont marqués comme non pris en compte, avec la raison indiquée. Les modèles testés de façon anonyme ne sont pas affichés, leur rang d'origine est conservé, avec un maximum de 30 par entrée.

Rang sur le classement d'origineModèle au classement d'origineScore brutConfiguration de référence
1claude-opus-5-5_maxAnthropic77.4%Max « inférence »Non pris en compte :Le protocole d'évaluation mono-modèle de cette source n'a pas encore été vérifié.
2claude-fable-5-1_highAnthropic73.3%High « inférence »Non pris en compte :Le protocole d'évaluation mono-modèle de cette source n'a pas encore été vérifié.
3claude-fable-5_highAnthropic63.9%High « inférence »Non pris en compte :Le protocole d'évaluation mono-modèle de cette source n'a pas encore été vérifié.
4gpt-6-astra_highOpenAI46.7%High « inférence »Non pris en compte :Le protocole d'évaluation mono-modèle de cette source n'a pas encore été vérifié.
5claude-opus-4-7_highAnthropic31.1%High « inférence »Non pris en compte :Le protocole d'évaluation mono-modèle de cette source n'a pas encore été vérifié.
6gpt-5.6-sol_highOpenAI20.0%High « inférence »Non pris en compte :Le protocole d'évaluation mono-modèle de cette source n'a pas encore été vérifié.
7gpt-5.4-2026-03-05_highOpenAI15.6%High « inférence »Non pris en compte :Le protocole d'évaluation mono-modèle de cette source n'a pas encore été vérifié.
8gpt-5.5_highOpenAI10.0%High « inférence »Non pris en compte :Le protocole d'évaluation mono-modèle de cette source n'a pas encore été vérifié.
9gemini-3.1-pro-preview_highGoogle8.9%High « inférence »Non pris en compte :Le protocole d'évaluation mono-modèle de cette source n'a pas encore été vérifié.
Limites de l'évaluation et attribution des données

Uniquement à titre indicatif, sans entrée dans les scores globaux ou de catégorie.

Licence des données :CC BY 4.0 · Epoch AI données d'évaluation propres

Résultats publiés par Epoch AI ; les scores bruts de chaque épreuve utilisent des échelles différentes et ne peuvent pas être additionnés directement ; le rang de référence applique des règles publiques de normalisation des écarts.