Aller au contenu

DeepSeek V4 Flash Preview

Poids open source ↗

DeepSeek · 2026-04-24 sortie · 10/03 20:40 mise à jour

Actu Créaflash note · globale21.1ptsRang de référence global · n° 600–100 points, pas un taux de réussite · Couverture des preuves 34%
Catégories comparables1/ 4 catégories
Résultats disponibles5évaluations
fenêtre de contexte—Token
API Entrée / sortie · par million de tokens¥0.94 / ¥1.88Cache ¥0.0188Prix catalogue $0.14 / $0.28Prix officiel du fournisseur
CAPABILITY PROFILE

Chacun ses forces, plus de clarté.

Chaque catégorie est notée séparément ; plus la note est élevée, meilleure est la performance dans cette catégorie. Pour le détail des capacités, voir les scores bruts et les configurations.

Les notes et les rangs de référence ne se comparent qu'au sein d'une même catégorie et d'une même série. Les tests manquants ne sont pas compensés ; le taux de couverture n'indique pas le niveau de capacité.

BEHIND THE SCORE

Chaque résultat a sa source.

Ci-dessous, les résultats publics agrégés de ce modèle. Dépliez pour voir la configuration d'exécution et le mode d'adoption.

Évaluations globales et expérience2 éléments

programmation2 éléments

« inférence »1 éléments

Évaluations sans résultats

Ces évaluations n'ont pas encore de résultats publics exploitables ; les mesures manquantes ne sont pas compensées.

Certaines inconnues subsistent

L'ordre de référence ne résume que les preuves publiques disponibles ; les mesures manquantes ne sont pas compensées. Des configurations d'exécution différentes, des erreurs inconnues ou de nouvelles évaluations peuvent modifier cet ordre : des rangs voisins n'impliquent pas un écart de capacité démontré.

Dimensions de capacité manquantes :Connaissances et faits, Compréhension visuelle, Tâches professionnelles sectorielles, Chinois et multilinguisme.

4 résultats retenus ne publient pas d'erreur standard exploitable ; l'inconnu n'est pas traité comme une erreur nulle.

En savoir plus sur la méthode de calcul →