Muse Spark 1.3
Meta · 2026-09-02 sortie · 10/03 20:40 mise à jour
Chacun ses forces, plus de clarté.
Chaque catégorie est notée séparément ; plus la note est élevée, meilleure est la performance dans cette catégorie. Pour le détail des capacités, voir les scores bruts et les configurations.
Les notes et les rangs de référence ne se comparent qu'au sein d'une même catégorie et d'une même série. Les tests manquants ne sont pas compensés ; le taux de couverture n'indique pas le niveau de capacité.
Chaque résultat a sa source.
Ci-dessous, les résultats publics agrégés de ce modèle. Dépliez pour voir la configuration d'exécution et le mode d'adoption.
Évaluations globales et expérience4 éléments
programmation1 éléments
« inférence »5 éléments
Travail professionnel2 éléments
Compréhension visuelle1 éléments
Évaluations sans résultats
Ces évaluations n'ont pas encore de résultats publics exploitables ; les mesures manquantes ne sont pas compensées.
Certaines inconnues subsistent
L'ordre de référence ne résume que les preuves publiques disponibles ; les mesures manquantes ne sont pas compensées. Des configurations d'exécution différentes, des erreurs inconnues ou de nouvelles évaluations peuvent modifier cet ordre : des rangs voisins n'impliquent pas un écart de capacité démontré.
Dimensions de capacité manquantes :Connaissances et faits, Chinois et multilinguisme.
7 résultats retenus ne publient pas d'erreur standard exploitable ; l'inconnu n'est pas traité comme une erreur nulle.
En savoir plus sur la méthode de calcul →