Arena Text Style-Controlled
LMArena · Des humains comparent anonymement des réponses par paires, pour voir laquelle ils préfèrent lire. Complète l'expérience globale que les QCM ne montrent pas.
Ce qu'il mesure, comment il le mesure
Ne prend que le classement principal Text Overall style-controlled des snapshots publiés officiellement, sans scraper arena.ai la page en temps réel.
Comment utiliser ces preuves
Le classement texte global sert uniquement de référence croisée ; la catégorie création étant déjà utilisée à part, plus aucun vote global n'est ajouté.
Scores d'évaluation
Selon des règles fixes, chaque modèle public utilise une configuration représentative ; les modèles sans configuration admissible sont marqués comme non pris en compte, avec la raison indiquée. Les modèles testés de façon anonyme ne sont pas affichés, leur rang d'origine est conservé, avec un maximum de 30 par entrée.
| Rang sur le classement d'origine | Modèle au classement d'origine | Score brut | Configuration de référence |
|---|---|---|---|
| 1 | gemini-4-argon-highGoogle | 1,525.2 | High « inférence »Non pris en compte :La préférence textuelle globale est un résultat composite ; elle sert uniquement au recoupement et n'est pas comptée en double avec les résultats détaillés. |
| 2 | claude-opus-4-6-highAnthropic | 1,504.7 | High « inférence »Non pris en compte :La préférence textuelle globale est un résultat composite ; elle sert uniquement au recoupement et n'est pas comptée en double avec les résultats détaillés. |
| 3 | claude-fable-5-highAnthropic | 1,504.3 | High « inférence »Non pris en compte :La préférence textuelle globale est un résultat composite ; elle sert uniquement au recoupement et n'est pas comptée en double avec les résultats détaillés. |
| 4 | claude-opus-5.5-highAnthropic | 1,503.7 | High « inférence »Non pris en compte :La préférence textuelle globale est un résultat composite ; elle sert uniquement au recoupement et n'est pas comptée en double avec les résultats détaillés. |
| 5 | claude-opus-4-7-highAnthropic | 1,501.3 | High « inférence »Non pris en compte :La préférence textuelle globale est un résultat composite ; elle sert uniquement au recoupement et n'est pas comptée en double avec les résultats détaillés. |
| 6 | claude-fable-5.1-maxAnthropic | 1,501.1 | Max « inférence »Non pris en compte :La préférence textuelle globale est un résultat composite ; elle sert uniquement au recoupement et n'est pas comptée en double avec les résultats détaillés. |
| 8 | gemini-3.8-flash-highGoogle | 1,494.8 | High « inférence »Non pris en compte :La préférence textuelle globale est un résultat composite ; elle sert uniquement au recoupement et n'est pas comptée en double avec les résultats détaillés. |
| 9 | muse-spark-1.3-maxMeta | 1,494.3 | Max « inférence »Non pris en compte :La préférence textuelle globale est un résultat composite ; elle sert uniquement au recoupement et n'est pas comptée en double avec les résultats détaillés. |
| 11 | muse-spark-1.2 (xHigh)Meta | 1,493.5 | xHigh « inférence »Non pris en compte :La préférence textuelle globale est un résultat composite ; elle sert uniquement au recoupement et n'est pas comptée en double avec les résultats détaillés. |
| 12 | muse-spark-1.1Meta | 1,491.3 | Configuration par défaut de la sourceNon pris en compte :La préférence textuelle globale est un résultat composite ; elle sert uniquement au recoupement et n'est pas comptée en double avec les résultats détaillés. |
| 14 | claude-opus-5-maxAnthropic | 1,489.5 | Max « inférence »Non pris en compte :La préférence textuelle globale est un résultat composite ; elle sert uniquement au recoupement et n'est pas comptée en double avec les résultats détaillés. |
| 15 | muse-sparkMeta | 1,489.3 | Configuration par défaut de la sourceNon pris en compte :La préférence textuelle globale est un résultat composite ; elle sert uniquement au recoupement et n'est pas comptée en double avec les résultats détaillés. |
| 16 | kimi-k3-maxMoonshot AI | 1,488.4 | Configuration par défaut de la sourceNon pris en compte :La préférence textuelle globale est un résultat composite ; elle sert uniquement au recoupement et n'est pas comptée en double avec les résultats détaillés. |
| 17 | gemini-3.7-flash-highGoogle | 1,487.7 | High « inférence »Non pris en compte :La préférence textuelle globale est un résultat composite ; elle sert uniquement au recoupement et n'est pas comptée en double avec les résultats détaillés. |
| 18 | gemini-3.1-pro-previewGoogle | 1,487 | Configuration par défaut de la sourceNon pris en compte :La préférence textuelle globale est un résultat composite ; elle sert uniquement au recoupement et n'est pas comptée en double avec les résultats détaillés. |
| 19 | gemini-3-proGoogle | 1,485.5 | Configuration par défaut de la sourceNon pris en compte :La préférence textuelle globale est un résultat composite ; elle sert uniquement au recoupement et n'est pas comptée en double avec les résultats détaillés. |
| 20 | gpt-5.6-sol-xhighOpenAI | 1,483.9 | xHigh « inférence »Non pris en compte :La préférence textuelle globale est un résultat composite ; elle sert uniquement au recoupement et n'est pas comptée en double avec les résultats détaillés. |
| 21 | gpt-6.1-sol-maxOpenAI | 1,483.2 | Max « inférence »Non pris en compte :La préférence textuelle globale est un résultat composite ; elle sert uniquement au recoupement et n'est pas comptée en double avec les résultats détaillés. |
| 22 | gemini-3.6-flash-highGoogle | 1,483 | High « inférence »Non pris en compte :La préférence textuelle globale est un résultat composite ; elle sert uniquement au recoupement et n'est pas comptée en double avec les résultats détaillés. |
| 23 | qwen3.8-maxAlibaba | 1,481.6 | Configuration par défaut de la sourceNon pris en compte :La préférence textuelle globale est un résultat composite ; elle sert uniquement au recoupement et n'est pas comptée en double avec les résultats détaillés. |
| 24 | claude-opus-4-8-highAnthropic | 1,481.5 | High « inférence »Non pris en compte :La préférence textuelle globale est un résultat composite ; elle sert uniquement au recoupement et n'est pas comptée en double avec les résultats détaillés. |
| 25 | gpt-5.5-highOpenAI | 1,481.4 | High « inférence »Non pris en compte :La préférence textuelle globale est un résultat composite ; elle sert uniquement au recoupement et n'est pas comptée en double avec les résultats détaillés. |
| 26 | mimo-v2.6-proXiaomi | 1,480.1 | Configuration par défaut de la sourceNon pris en compte :La préférence textuelle globale est un résultat composite ; elle sert uniquement au recoupement et n'est pas comptée en double avec les résultats détaillés. |
| 27 | glm-5.3-maxZ.ai | 1,478.5 | Configuration par défaut de la sourceNon pris en compte :La préférence textuelle globale est un résultat composite ; elle sert uniquement au recoupement et n'est pas comptée en double avec les résultats détaillés. |
| 28 | gemini-3.5-flash-highGoogle | 1,477.4 | High « inférence »Non pris en compte :La préférence textuelle globale est un résultat composite ; elle sert uniquement au recoupement et n'est pas comptée en double avec les résultats détaillés. |
| 29 | gpt-6-astra-maxOpenAI | 1,477.1 | Max « inférence »Non pris en compte :La préférence textuelle globale est un résultat composite ; elle sert uniquement au recoupement et n'est pas comptée en double avec les résultats détaillés. |
| 32 | glm-5.2-maxZ.ai | 1,475.8 | Configuration par défaut de la sourceNon pris en compte :La préférence textuelle globale est un résultat composite ; elle sert uniquement au recoupement et n'est pas comptée en double avec les résultats détaillés. |
| 33 | gpt-5.2-chat-latest-20260210OpenAI | 1,475.7 | Configuration par défaut de la sourceNon pris en compte :La préférence textuelle globale est un résultat composite ; elle sert uniquement au recoupement et n'est pas comptée en double avec les résultats détaillés. |
| 34 | gpt-5.4-highOpenAI | 1,475.2 | High « inférence »Non pris en compte :La préférence textuelle globale est un résultat composite ; elle sert uniquement au recoupement et n'est pas comptée en double avec les résultats détaillés. |
| 35 | qwen3.7-max-previewAlibaba | 1,474.9 | Configuration par défaut de la sourceNon pris en compte :La préférence textuelle globale est un résultat composite ; elle sert uniquement au recoupement et n'est pas comptée en double avec les résultats détaillés. |
Limites de l'évaluation et attribution des données
Les préférences humaines dépendent du style, de la structure des utilisateurs et de la distribution des prompts ; le classement global et les catégories se recoupent.
Licence des données :CC BY 4.0
Résultats publiés par LMArena ; les scores bruts de chaque épreuve utilisent des échelles différentes et ne peuvent pas être additionnés directement ; le rang de référence applique des règles publiques de normalisation des écarts.