Aller au contenu

DeepSeek V4 Pro Preview

Poids open source ↗

DeepSeek · 2026-04-24 sortie · 10/03 20:40 mise à jour

Actu Créaflash note · globale34.6ptsRang de référence global · n° 450–100 points, pas un taux de réussite · Couverture des preuves 63%
Catégories comparables3/ 4 catégories
Résultats disponibles12évaluations
fenêtre de contexte—Token
API Entrée / sortie · par million de tokens¥2.92 / ¥5.83Cache ¥0.0243Prix catalogue $0.435 / $0.87Prix officiel du fournisseur
CAPABILITY PROFILE

Chacun ses forces, plus de clarté.

Chaque catégorie est notée séparément ; plus la note est élevée, meilleure est la performance dans cette catégorie. Pour le détail des capacités, voir les scores bruts et les configurations.

Les notes et les rangs de référence ne se comparent qu'au sein d'une même catégorie et d'une même série. Les tests manquants ne sont pas compensés ; le taux de couverture n'indique pas le niveau de capacité.

BEHIND THE SCORE

Chaque résultat a sa source.

Ci-dessous, les résultats publics agrégés de ce modèle. Dépliez pour voir la configuration d'exécution et le mode d'adoption.

Évaluations globales et expérience2 éléments

programmation2 éléments

« inférence »5 éléments

Connaissance2 éléments

Travail professionnel1 éléments

Évaluations sans résultats

Ces évaluations n'ont pas encore de résultats publics exploitables ; les mesures manquantes ne sont pas compensées.

Certaines inconnues subsistent

L'ordre de référence ne résume que les preuves publiques disponibles ; les mesures manquantes ne sont pas compensées. Des configurations d'exécution différentes, des erreurs inconnues ou de nouvelles évaluations peuvent modifier cet ordre : des rangs voisins n'impliquent pas un écart de capacité démontré.

Dimensions de capacité manquantes :Compréhension visuelle, Chinois et multilinguisme.

4 résultats retenus ne publient pas d'erreur standard exploitable ; l'inconnu n'est pas traité comme une erreur nulle.

En savoir plus sur la méthode de calcul →