Trier et extraire.
Trier, étiqueter et extraire des données structurées à grand volume.
Les recommandations WoBench reposent sur des évaluations humaines.
Boîte professionnelle à trier. 800 tokens en entrée et 40 en sortie par exécution
Verdicts rendus parmi les 152 modèles mesurés sur ce que cette tâche exige, sur 321 au banc. Les 169 autres
64 modèles au niveau sur 152 mesurés, 321 au banc.
montants convertis au taux de la Banque centrale européenne du 22 septembre 2026
Barre 1 425,0, la borne basse de sa fourchette : c'est elle qui coupe. Le segment est la fourchette de ce modèle : il est au niveau dès que sa borne haute atteint celle de la barre. Le meilleur de la tâche est à 1 504,5, sa note garantie.
Barre de la mesure, borne basse : 1 425,0. Fourchette 1 425,0 à 1 437,5, posée le 23 septembre 2026 sur 152 modèles, inchangée depuis.
151 fois moins cher que Le meilleur. 7 modèles moins chers n'atteignent pas la barre.
Barre 1 425,0, la borne basse de sa fourchette : c'est elle qui coupe. Le segment est la fourchette de ce modèle : il est au niveau dès que sa borne haute atteint celle de la barre. Le meilleur de la tâche est à 1 504,5, sa note garantie.
Barre de la mesure, borne basse : 1 425,0. Fourchette 1 425,0 à 1 437,5, posée le 23 septembre 2026 sur 152 modèles, inchangée depuis.
99 % moins cher que Le meilleur, 40,5 points de mesure en moins.
Barre 1 425,0, la borne basse de sa fourchette : c'est elle qui coupe. Le segment est la fourchette de ce modèle : il est au niveau dès que sa borne haute atteint celle de la barre. Le meilleur de la tâche est à 1 504,5, sa note garantie.
Barre de la mesure, borne basse : 1 425,0. Fourchette 1 425,0 à 1 437,5, posée le 23 septembre 2026 sur 152 modèles, inchangée depuis.
1er sur les 152 modèles que cette tâche juge. 151 fois le prix de Peut faire le job, pour 73,3 points de mesure en plus.
Un autre modèle est statistiquement indiscernable de celui ci sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style : l'écart existe, il n'est pas mesurable. La liste complète de la page les situe.
Le meilleur en coûte 11,17 €. Entre les deux, 62 autres, et voici où ils tombent.
Arrivés au niveau
Au niveau, et notés pour la première fois depuis moins de 45 jours. Ils sont jugés comme les autres dès leur première note : leur note repose simplement sur moins de votes.
- Gemini 3.7 Flash 1 484,4
- GLM 5.3 1 480,4
- GLM 5.3 Flash 1 470,8
- Grok 4.6 1 452,6
- Qwen3.8 27B 1 424,0
Cette tâche exige une note d'au moins 1 431,2 sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style. Cette barre appartient à la mesure, elle ne bouge pas, et toutes les tâches qui lisent cette mesure exigent la même : c'est la note du modèle qui la franchit, donc le doute lui profite.
Comment ce verdict est calculé
Le seuil de cette tâche
préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
Barre de la mesure, borne basse : 1 425,0. Fourchette 1 425,0 à 1 437,5, posée le 23 septembre 2026 sur 152 modèles, inchangée depuis.
Barrières
Aucune barrière : la présence dans la mesure vaut capacité.
Coût mensuel = entrée hors cache × prix d'entrée + entrée en cache × prix du cache + sortie × prix de sortie. L'écriture de cache est exclue en V1.
Sources de cette page
D'où viennent ces chiffres
- Taux de référence de la Banque centrale européenne (ecb.europa.eu) Réutilisation libre avec citation de la source https://www.ecb.europa.eu/stats/eurofxref/eurofxref-daily.xml
- Epoch AI (epoch.ai) CC-BY https://epoch.ai/benchmarks/use-this-data
- LiteLLM (github.com/BerriAI/litellm) MIT https://github.com/BerriAI/litellm
- LMArena (lmarena.ai) CC-BY-4.0 https://huggingface.co/datasets/lmarena-ai/leaderboard-dataset
- models.dev MIT https://models.dev
- Prix et fournisseurs : OpenRouter (openrouter.ai) CGU OpenRouter https://openrouter.ai/docs
- Prix et caractéristiques : OpenRouter (openrouter.ai) CGU OpenRouter https://openrouter.ai/api/v1/models
- Agent conversationnel : tau²-bench, Sierra Research (github.com/sierra-research) MIT https://github.com/sierra-research/tau2-bench
- Fidélité au document : classement d'hallucination de Vectara (github.com/vectara) Apache-2.0 https://github.com/vectara/hallucination-leaderboard
Prix relevés une fois par jour, à 3h00 (heure de Paris). Licences, attributions et modifications
Ces chiffres viennent des sources publiques citées et reflètent le dernier import, pas l'état à la seconde. Les tarifs sont ceux publiés par les fournisseurs et peuvent changer sans préavis : vérifiez les chez eux avant de vous engager. Nos verdicts orientent un choix, ils ne le garantissent pas : à vous de tester le modèle sur vos propres cas et de valider votre calcul, y compris économique. Notre méthode
Le badge de ce verdict
Collez cet extrait sur votre site. Le badge se met à jour tout seul. Dès que le modèle ne tient plus le verdict, il n'affiche plus que la date de sa dernière vérification : nous ne laissons jamais un verdict périmé chez un tiers.
Tous les modèles mesurés
Le classement entier sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style, du meilleur au moins bon, avec la barre à sa place. La note garantie est la borne basse de la fourchette publiée : c'est elle qui décide de l'élection.
La barre vaut 1 431,2, sa fourchette va de 1 425,0 à 1 437,5, et c'est sa borne basse, 1 425,0, qui coupe. Elle a été posée le 23 septembre 2026 sur 152 modèles, et n'a pas bougé depuis.
| Rang | Modèle | Note | Fourchette | Coût mensuel | Sort |
|---|---|---|---|---|---|
| 1 |
Claude Fable 5
Anthropic
|
1 511,3 | 1 504,5 à 1 518,0 | 11,17 € | Le meilleur |
| 2 |
Claude Opus 4.6
Anthropic
|
1 499,8 | 1 494,7 à 1 504,9 | 5,58 € | retenu |
| 3 |
Claude Opus 5
Anthropic
|
1 493,2 | 1 485,2 à 1 501,1 | 5,58 € | retenu |
| 4 |
Claude Opus 4.7
Anthropic
|
1 492,6 | 1 487,0 à 1 498,1 | 5,58 € | retenu |
| 5 |
GPT-5.6 Sol
OpenAI
|
1 486,9 | 1 479,8 à 1 494,0 | 3,63 € | retenu |
| 6 |
Gemini 3.7 Flash
première note
Google
|
1 484,4 | 1 470,8 à 1 498,1 | 1,36 € | retenu |
| 7 |
Kimi K3
Moonshot AI
|
1 483,7 | 1 476,0 à 1 491,5 | 2,34 € | retenu |
| 8 |
Claude Opus 4.5
Anthropic
|
1 483,0 | 1 476,3 à 1 489,8 | 9,07 € | retenu |
| 9 |
Gemini 3.1 Pro Preview
préversion
Google
|
1 481,0 | 1 476,5 à 1 485,6 | 2,37 € | retenu |
| 10 |
GLM 5.3
première note
Z.ai
|
1 480,4 | 1 470,3 à 1 490,5 | 0,59 € | retenu |
| 11 |
Muse Spark 1.2
Meta
|
1 480,1 | 1 462,8 à 1 497,5 | 1,27 € | retenu |
| 12 |
Claude Opus 4.8
Anthropic
|
1 477,3 | 1 471,5 à 1 483,0 | 5,58 € | retenu |
| 13 |
Claude Sonnet 4.6
Anthropic
|
1 476,1 | 1 470,8 à 1 481,4 | 3,35 € | retenu |
| 14 |
GPT-5.5
OpenAI
|
1 473,2 | 1 467,9 à 1 478,6 | 5,93 € | retenu |
| 15 |
Gemini 3.6 Flash
Google
|
1 473,0 | 1 466,0 à 1 480,1 | 1,36 € | retenu |
| 16 |
Muse Spark 1.1
Meta
|
1 471,4 | 1 464,5 à 1 478,2 | 1,27 € | retenu |
| 17 |
GLM 5.3 Flash
première note
Z.ai
|
1 470,8 | 1 460,5 à 1 481,2 | 0,0952 € | Meilleur compromis |
| 18 |
MiMo-V2.5-Pro
Xiaomi
|
1 470,3 | 1 464,8 à 1 475,8 | 0,26 € | retenu |
| 19 |
GLM 5.2
Z.ai
|
1 466,2 | 1 459,8 à 1 472,5 | 0,59 € | retenu |
| 20 |
Grok 4.5
xAI
|
1 466,1 | 1 459,4 à 1 472,8 | 2,02 € | retenu |
| 21 |
Claude Sonnet 5
Anthropic
|
1 464,9 | 1 458,5 à 1 471,2 | 3,63 € | retenu |
| 22 |
Qwen3.7 Max
Qwen
|
1 464,4 | 1 447,3 à 1 481,4 | 1,54 € | retenu |
| 23 |
Claude Sonnet 4.5
Anthropic
|
1 464,0 | 1 459,4 à 1 468,6 | 5,44 € | retenu |
| 24 |
Gemini 3.5 Flash
Google
|
1 463,1 | 1 456,9 à 1 469,4 | 1,78 € | retenu |
| 25 |
GPT-5.6 Terra
OpenAI
|
1 462,1 | 1 455,2 à 1 469,0 | 4,05 € | retenu |
| 26 |
GPT-5.4
OpenAI
|
1 461,1 | 1 455,5 à 1 466,6 | 2,97 € | retenu |
| 27 |
GLM 5.1
Z.ai
|
1 460,5 | 1 455,0 à 1 466,0 | 0,97 € | retenu |
| 28 |
Claude Opus 4.1
Anthropic
|
1 459,0 | 1 453,3 à 1 464,8 | 16,75 € | retenu |
| 29 |
Gemini 3 Flash Preview
préversion
Google
|
1 458,7 | 1 451,4 à 1 465,9 | 0,59 € | retenu |
| 30 |
GPT-5.2 Chat
OpenAI
|
1 457,2 | 1 450,8 à 1 463,6 | 2,32 € | retenu |
| 31 |
Kimi K2.6
Moonshot AI
|
1 453,7 | 1 447,3 à 1 460,2 | 0,64 € | retenu |
| 32 |
Grok 4.6
première note
xAI
|
1 452,6 | 1 444,1 à 1 461,1 | 3,00 € | retenu |
| 33 |
DeepSeek V4 Pro 0423
DeepSeek
|
1 452,6 | 1 446,8 à 1 458,3 | 0,86 € | retenu |
| 34 |
Gemma 4 31B
Google
|
1 452,1 | 1 438,2 à 1 466,1 | 0,12 € | retenu |
| 35 |
Grok 4.20
xAI
|
1 449,5 | 1 442,4 à 1 456,6 | 1,19 € | retenu |
| 36 |
Qwen3.6 Max Preview
préversion
Qwen
|
1 449,4 | 1 435,2 à 1 463,5 | 1,86 € | retenu |
| 37 |
Qwen3.7 Plus
Qwen
|
1 447,1 | 1 441,0 à 1 453,2 | 0,36 € | retenu |
| 38 |
GLM 5
Z.ai
|
1 446,3 | 1 439,6 à 1 453,1 | 0,64 € | retenu |
| 39 |
Hy3
Tencent
|
1 444,0 | 1 432,5 à 1 455,5 | 0,15 € | retenu |
| 40 |
Grok 4.20 Multi-Agent
xAI
|
1 443,3 | 1 437,8 à 1 448,7 | 1,19 € | retenu |
| 41 |
GPT-5.6 Luna
OpenAI
|
1 442,2 | 1 435,3 à 1 449,1 | 0,40 € | retenu |
| 42 |
Gemini 3.5 Flash Lite
Google
|
1 441,7 | 1 434,6 à 1 448,9 | 0,40 € | retenu |
| 43 |
Kimi K2.5
Moonshot AI
|
1 439,2 | 1 434,2 à 1 444,2 | 0,66 € | retenu |
| 44 |
Gemini 2.5 Pro
Google
|
1 438,3 | 1 434,4 à 1 442,2 | 1,66 € | retenu |
| 45 |
Gemma 4 26B A4B
Google
|
1 438,0 | 1 424,1 à 1 452,0 | 0,074 € | Peut faire le job |
| 46 |
Qwen3.6 Plus
Qwen
|
1 436,1 | 1 430,0 à 1 442,2 | 0,59 € | retenu |
| 47 |
Qwen3.5 397B A17B
Qwen
|
1 434,5 | 1 429,7 à 1 439,3 | 0,68 € | retenu |
| 48 |
GPT-5.4 Mini
OpenAI
|
1 434,3 | 1 428,7 à 1 439,8 | 1,52 € | retenu |
| 49 |
MiniMax M3
MiniMax
|
1 434,1 | 1 428,3 à 1 440,0 | 0,27 € | retenu |
| 50 |
MiMo-V2.5
Xiaomi
|
1 431,2 | 1 425,0 à 1 437,5 | 0,10 € | retenu |
| 51 |
DeepSeek V4 Flash 0423
DeepSeek
|
1 428,1 | 1 422,1 à 1 434,0 | 0,0849 € | retenu |
| 52 |
GLM 4.7
Z.ai
|
1 426,9 | 1 416,5 à 1 437,3 | 0,58 € | retenu |
| 53 |
GPT-5.1
OpenAI
|
1 426,8 | 1 420,7 à 1 432,9 | 1,66 € | retenu |
| 54 |
Qwen3 Max
Qwen
|
1 425,6 | 1 418,2 à 1 432,9 | 0,93 € | retenu |
| 55 |
GPT-5.2
OpenAI
|
1 424,3 | 1 419,4 à 1 429,1 | 2,32 € | retenu |
| 56 |
Qwen3.8 27B
première note
Qwen
|
1 424,0 | 1 414,0 à 1 434,1 | 0,26 € | retenu |
| 57 |
GLM 5V Turbo
Z.ai
|
1 422,2 | 1 411,5 à 1 432,9 | 1,28 € | retenu |
| 58 |
Mistral Medium 3.5
Mistral
|
1 421,4 | 1 411,1 à 1 431,8 | 2,62 € | retenu |
| 59 |
DeepSeek V3.1 Terminus
DeepSeek
|
1 421,0 | 1 400,8 à 1 441,2 | 0,35 € | retenu |
| 60 |
Inkling
Thinking Machines
|
1 420,9 | 1 413,9 à 1 428,0 | 1,06 € | retenu |
| 61 |
DeepSeek V3.2
DeepSeek
|
1 420,1 | 1 414,3 à 1 425,9 | 0,18 € | retenu |
| La coupure : un modèle est au niveau quand sa borne haute atteint 1 425,0. Au dessus, les modèles au niveau ; en dessous, les autres. | |||||
| 62 |
Kimi K2 Thinking
Moonshot AI
|
1 418,0 | 1 413,0 à 1 423,1 | 0,70 € | sous la barre |
| 63 |
DeepSeek V3.1
DeepSeek
|
1 416,4 | 1 405,3 à 1 427,5 | 0,35 € | retenu |
| 64 |
Qwen3 235B A22B Instruct 2507
Qwen
|
1 415,4 | 1 411,3 à 1 419,6 | 0,0977 € | sous la barre |
| 65 |
Muse Glimmer 30B
Meta
|
1 415,4 | 1 398,7 à 1 432,1 | 0,31 € | retenu |
| 66 |
Claude Sonnet 4
Anthropic
|
1 415,1 | 1 408,1 à 1 422,0 | 3,35 € | sous la barre |
| 67 |
Grok 4.3
xAI
|
1 414,8 | 1 409,4 à 1 420,2 | 1,19 € | sous la barre |
| 68 |
DeepSeek V3.2 Exp
DeepSeek
|
1 414,8 | 1 404,4 à 1 425,1 | 0,41 € | retenu |
| 69 |
GLM 4.6
Z.ai
|
1 413,5 | 1 407,2 à 1 419,9 | 0,61 € | sous la barre |
| 70 |
GPT-5
OpenAI
|
1 410,9 | 1 403,6 à 1 418,1 | 3,05 € | sous la barre |
| 71 |
Qwen3 VL 235B A22B Instruct
Qwen
|
1 410,0 | 1 398,7 à 1 421,3 | 0,28 € | sous la barre |
| 72 |
Gemini 3.1 Flash Lite Preview
préversion
Google
|
1 406,8 | 1 401,4 à 1 412,3 | 0,30 € | sous la barre |
| 73 |
MiniMax M2.7
MiniMax
|
1 406,8 | 1 401,7 à 1 412,0 | 0,23 € | sous la barre |
| 74 |
Qwen3.5-122B-A10B
Qwen
|
1 406,8 | 1 400,1 à 1 413,5 | 0,51 € | sous la barre |
| 75 |
GLM 4.5
Z.ai
|
1 404,4 | 1 396,5 à 1 412,3 | 0,65 € | sous la barre |
| 76 |
Nemotron 3 Ultra
NVIDIA
|
1 403,6 | 1 393,3 à 1 413,8 | 0,79 € | sous la barre |
| 77 |
Gemini 2.5 Flash
Google
|
1 400,3 | 1 396,5 à 1 404,2 | 0,40 € | sous la barre |
| 78 |
Hy3 preview
préversion
Tencent
|
1 400,1 | 1 387,4 à 1 412,9 | 0,21 € | sous la barre |
| 79 |
Qwen3.5-27B
Qwen
|
1 400,1 | 1 393,3 à 1 406,9 | 0,38 € | sous la barre |
| 80 |
R1
DeepSeek
|
1 397,2 | 1 389,7 à 1 404,7 | 1,15 € | sous la barre |
| 81 |
Mistral Medium 3.1
Mistral
|
1 395,4 | 1 391,2 à 1 399,6 | 0,45 € | sous la barre |
| 82 |
Inkling Small
Thinking Machines
|
1 393,2 | 1 385,4 à 1 401,1 | 0,47 € | sous la barre |
| 83 |
R1 0528
DeepSeek
|
1 390,7 | 1 381,1 à 1 400,2 | 0,85 € | sous la barre |
| 84 |
Kimi K2 0711
Moonshot AI
|
1 388,8 | 1 377,8 à 1 399,8 | 0,96 € | sous la barre |
| 85 |
Qwen3.5-35B-A3B
Qwen
|
1 387,8 | 1 381,2 à 1 394,5 | 0,20 € | sous la barre |
| 86 |
GPT-5.4 Nano
OpenAI
|
1 387,4 | 1 381,8 à 1 393,1 | 0,42 € | sous la barre |
| 87 |
Qwen3 235B A22B Thinking 2507
Qwen
|
1 385,2 | 1 372,7 à 1 397,7 | 0,48 € | sous la barre |
| 88 |
Step 3.5 Flash
StepFun
|
1 384,9 | 1 379,5 à 1 390,3 | 0,16 € | sous la barre |
| 89 |
MiniMax M2.1
MiniMax
|
1 383,2 | 1 374,2 à 1 392,2 | 0,31 € | sous la barre |
| 90 |
Qwen3 VL 235B A22B Thinking
Qwen
|
1 382,9 | 1 370,5 à 1 395,2 | 0,84 € | sous la barre |
| 91 |
Qwen3.5-Flash
Qwen
|
1 381,8 | 1 376,3 à 1 387,2 | 0,11 € | sous la barre |
| 92 |
MiniMax M2.5
MiniMax
|
1 380,2 | 1 374,2 à 1 386,3 | 0,28 € | sous la barre |
| 93 |
DeepSeek V3 0324
DeepSeek
|
1 378,3 | 1 372,4 à 1 384,2 | 0,36 € | sous la barre |
| 94 |
Qwen3 Next 80B A3B Instruct
Qwen
|
1 376,8 | 1 369,1 à 1 384,4 | 0,19 € | sous la barre |
| 95 |
GPT-5 Mini
OpenAI
|
1 372,3 | 1 364,7 à 1 379,9 | 0,61 € | sous la barre |
| 96 |
GLM 4.6V
Z.ai
|
1 370,2 | 1 348,4 à 1 392,0 | 0,31 € | sous la barre |
| 97 |
Gemini 2.5 Flash Lite
Google
|
1 369,0 | 1 361,9 à 1 376,0 | 0,10 € | sous la barre |
| 98 |
o3 Mini High
OpenAI
|
1 366,3 | 1 358,6 à 1 373,9 | 2,07 € | sous la barre |
| 99 |
Qwen3 30B A3B Instruct 2507
Qwen
|
1 366,0 | 1 358,1 à 1 373,9 | 0,0807 € | sous la barre |
| 100 |
Mistral Medium 3
Mistral
|
1 365,9 | 1 358,7 à 1 373,1 | 0,45 € | sous la barre |
| 101 |
Solar Pro 4
première note
Upstage
|
1 361,3 | 1 341,0 à 1 381,5 | 0,10 € | sous la barre |
| 102 |
GLM 4.5 Air
Z.ai
|
1 361,0 | 1 354,1 à 1 367,9 | 0,17 € | sous la barre |
| 103 |
Qwen3 Next 80B A3B Thinking
Qwen
|
1 358,8 | 1 348,9 à 1 368,8 | 0,29 € | sous la barre |
| 104 |
Trinity Large Thinking
Arcee AI
|
1 358,3 | 1 351,4 à 1 365,3 | 0,27 € | sous la barre |
| 105 |
Qwen3 235B A22B
Qwen
|
1 356,6 | 1 348,8 à 1 364,3 | 0,76 € | sous la barre |
| 106 |
GLM 4.7 Flash
Z.ai
|
1 348,7 | 1 338,3 à 1 359,1 | 0,0768 € | sous la barre |
| 107 |
MiniMax M1
MiniMax
|
1 346,1 | 1 339,4 à 1 352,9 | 0,71 € | sous la barre |
| 108 |
Nemotron 3 Super
NVIDIA
|
1 345,1 | 1 332,2 à 1 358,1 | 0,14 € | sous la barre |
| 109 |
o3 Mini
OpenAI
|
1 343,6 | 1 338,5 à 1 348,8 | 1,46 € | sous la barre |
| 110 |
Gemma 3 27B
Google
|
1 343,6 | 1 337,8 à 1 349,3 | 0,12 € | sous la barre |
| 111 |
DeepSeek V3
DeepSeek
|
1 343,3 | 1 336,4 à 1 350,2 | 0,43 € | sous la barre |
| 112 |
Command A
Cohere
|
1 341,6 | 1 336,2 à 1 346,9 | 4,19 € | sous la barre |
| 113 |
GLM 4.5V
Z.ai
|
1 339,8 | 1 323,9 à 1 355,7 | 0,62 € | sous la barre |
| 114 |
Mistral Small 3.2 24B
Mistral
|
1 338,0 | 1 329,1 à 1 346,9 | 0,12 € | sous la barre |
| 115 |
MiniMax M2
MiniMax
|
1 337,4 | 1 324,3 à 1 350,4 | 0,31 € | sous la barre |
| 116 |
Qwen-Plus
Qwen
|
1 331,8 | 1 319,6 à 1 343,9 | 0,27 € | sous la barre |
| 117 |
Qwen3 32B
Qwen
|
1 331,1 | 1 312,1 à 1 350,1 | 0,13 € | sous la barre |
| 118 |
Nova 2 Lite
Amazon
|
1 327,6 | 1 317,2 à 1 338,0 | 0,59 € | sous la barre |
| 119 |
GPT-5 Nano
OpenAI
|
1 327,1 | 1 314,0 à 1 340,2 | 0,12 € | sous la barre |
| 120 |
GPT-4o (2024-05-13)
OpenAI
|
1 325,5 | 1 320,4 à 1 330,5 | 8,03 € | sous la barre |
| 121 |
gpt-oss-120b
OpenAI
|
1 324,1 | 1 317,0 à 1 331,2 | 0,0537 € | sous la barre |
| 122 |
Mercury 2
Inception
|
1 323,5 | 1 303,5 à 1 343,6 | 0,24 € | sous la barre |
| 123 |
Gemma 3 12B
Google
|
1 321,1 | 1 304,8 à 1 337,4 | 0,0803 € | sous la barre |
| 124 |
GPT-4o (2024-08-06)
OpenAI
|
1 318,5 | 1 312,7 à 1 324,3 | 3,32 € | sous la barre |
| 125 |
Llama 4 Maverick
Meta
|
1 313,4 | 1 306,9 à 1 319,9 | 0,31 € | sous la barre |
| 126 |
Qwen3 30B A3B
Qwen
|
1 310,1 | 1 302,2 à 1 318,0 | 0,20 € | sous la barre |
| 127 |
Mistral Large 2407
Mistral
|
1 299,3 | 1 293,6 à 1 305,0 | 1,95 € | sous la barre |
| 128 |
Llama 4 Scout
Meta
|
1 298,9 | 1 291,6 à 1 306,2 | 0,16 € | sous la barre |
| 129 |
Mistral Large
Mistral
|
1 294,6 | 1 288,6 à 1 300,7 | 1,95 € | sous la barre |
| 130 |
Mistral Small 3.1 24B
Mistral
|
1 293,7 | 1 286,6 à 1 300,8 | 0,53 € | sous la barre |
| 131 |
GPT-4o-mini (2024-07-18)
OpenAI
|
1 293,1 | 1 288,3 à 1 298,0 | 0,20 € | sous la barre |
| 132 |
Llama 3.3 70B Instruct
Meta
|
1 292,6 | 1 287,6 à 1 297,7 | 0,16 € | sous la barre |
| 133 |
Qwen2.5 72B Instruct
Qwen
|
1 292,0 | 1 286,4 à 1 297,7 | 0,53 € | sous la barre |
| 134 |
Nemotron 3 Nano 30B A3B
NVIDIA
|
1 290,5 | 1 281,2 à 1 299,9 | 0,0698 € | sous la barre |
| 135 |
GPT-4
OpenAI
|
1 284,8 | 1 277,5 à 1 292,1 | 46,06 € | sous la barre |
| 136 |
gpt-oss-20b
OpenAI
|
1 281,3 | 1 269,1 à 1 293,5 | 0,0314 € | sous la barre |
| 137 |
Nova Pro 1.0
Amazon
|
1 276,5 | 1 270,2 à 1 282,8 | 1,34 € | sous la barre |
| 138 |
Granite 4.2 8B
première note
IBM
|
1 275,0 | 1 255,4 à 1 294,5 | 0,0698 € | sous la barre |
| 139 |
Llama 3.1 70B Instruct
Meta
|
1 272,6 | 1 267,2 à 1 277,9 | 0,59 € | sous la barre |
| 140 |
Gemma 3 4B
Google
|
1 267,5 | 1 251,1 à 1 283,8 | 0,0768 € | sous la barre |
| 141 |
Qwen2.5 Coder 32B Instruct
Qwen
|
1 264,0 | 1 252,1 à 1 276,0 | 0,99 € | sous la barre |
| 142 |
Mistral Small 3
Mistral
|
1 255,3 | 1 247,1 à 1 263,6 | 0,0754 € | sous la barre |
| 143 |
Command R+ (08-2024)
Cohere
|
1 253,8 | 1 244,5 à 1 263,2 | 4,19 € | sous la barre |
| 144 |
Phi 4
Microsoft
|
1 245,4 | 1 238,7 à 1 252,0 | 0,11 € | sous la barre |
| 145 |
Nova Lite 1.0
Amazon
|
1 243,6 | 1 236,5 à 1 250,8 | 0,10 € | sous la barre |
| 146 |
Command R (08-2024)
Cohere
|
1 235,8 | 1 226,5 à 1 245,1 | 0,25 € | sous la barre |
| 147 |
GPT-3.5 Turbo
OpenAI
|
1 215,1 | 1 208,7 à 1 221,5 | 0,80 € | sous la barre |
| 148 |
Mixtral 8x22B Instruct
Mistral
|
1 215,1 | 1 208,5 à 1 221,6 | 1,95 € | sous la barre |
| 149 |
Nova Micro 1.0
Amazon
|
1 214,8 | 1 207,7 à 1 222,0 | 0,0586 € | sous la barre |
| 150 |
Llama 3.1 8B Instruct
Meta
|
1 190,9 | 1 185,3 à 1 196,5 | 0,0307 € | sous la barre |
| 151 |
Llama 3.2 3B Instruct
Meta
|
1 146,1 | 1 135,0 à 1 157,1 | 0,0928 € | sous la barre |
| 152 |
Llama 3.2 1B Instruct
Meta
|
1 085,7 | 1 074,3 à 1 097,2 | 0,0517 € | sous la barre |
Ce que devient le banc sur cette tâche
Les cinq populations forment une partition du banc : leur somme vaut le nombre de modèles au banc, sur chaque tâche, à chaque calcul.
0 modèle écarté par une barrière
aucun
64 modèles mesurés et éligibles
- Claude Fable 5
- Claude Opus 4.1
- Claude Opus 4.5
- Claude Opus 4.6
- Claude Opus 4.7
- Claude Opus 4.8
- Claude Opus 5
- Claude Sonnet 4.5
- Claude Sonnet 4.6
- Claude Sonnet 5
- DeepSeek V3.1
- DeepSeek V3.1 Terminus
- DeepSeek V3.2
- DeepSeek V3.2 Exp
- DeepSeek V4 Flash 0423
- DeepSeek V4 Pro 0423
- GLM 4.7
- GLM 5
- GLM 5.1
- GLM 5.2
- GLM 5.3
- GLM 5.3 Flash
- GLM 5V Turbo
- GPT-5.1
- GPT-5.2
- GPT-5.2 Chat
- GPT-5.4
- GPT-5.4 Mini
- GPT-5.5
- GPT-5.6 Luna
- GPT-5.6 Sol
- GPT-5.6 Terra
- Gemini 2.5 Pro
- Gemini 3 Flash Preview
- Gemini 3.1 Pro Preview
- Gemini 3.5 Flash
- Gemini 3.5 Flash Lite
- Gemini 3.6 Flash
- Gemini 3.7 Flash
- Gemma 4 26B A4B
- Gemma 4 31B
- Grok 4.20
- Grok 4.20 Multi-Agent
- Grok 4.5
- Grok 4.6
- Hy3
- Inkling
- Kimi K2.5
- Kimi K2.6
- Kimi K3
- MiMo-V2.5
- MiMo-V2.5-Pro
- MiniMax M3
- Mistral Medium 3.5
- Muse Glimmer 30B
- Muse Spark 1.1
- Muse Spark 1.2
- Qwen3 Max
- Qwen3.5 397B A17B
- Qwen3.6 Max Preview
- Qwen3.6 Plus
- Qwen3.7 Max
- Qwen3.7 Plus
- Qwen3.8 27B
88 modèles mesurés sous le seuil
- Claude Sonnet 4 : 1 415,1, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- Command A : 1 341,6, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- Command R (08-2024) : 1 235,8, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- Command R+ (08-2024) : 1 253,8, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- DeepSeek V3 : 1 343,3, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- DeepSeek V3 0324 : 1 378,3, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- GLM 4.5 : 1 404,4, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- GLM 4.5 Air : 1 361,0, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- GLM 4.5V : 1 339,8, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- GLM 4.6 : 1 413,5, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- GLM 4.6V : 1 370,2, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- GLM 4.7 Flash : 1 348,7, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- GPT-3.5 Turbo : 1 215,1, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- GPT-4 : 1 284,8, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- GPT-4o (2024-05-13) : 1 325,5, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- GPT-4o (2024-08-06) : 1 318,5, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- GPT-4o-mini (2024-07-18) : 1 293,1, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- GPT-5 : 1 410,9, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- GPT-5 Mini : 1 372,3, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- GPT-5 Nano : 1 327,1, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- GPT-5.4 Nano : 1 387,4, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- Gemini 2.5 Flash : 1 400,3, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- Gemini 2.5 Flash Lite : 1 369,0, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- Gemini 3.1 Flash Lite Preview : 1 406,8, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- Gemma 3 12B : 1 321,1, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- Gemma 3 27B : 1 343,6, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- Gemma 3 4B : 1 267,5, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- Granite 4.2 8B : 1 275,0, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- Grok 4.3 : 1 414,8, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- Hy3 preview : 1 400,1, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- Inkling Small : 1 393,2, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- Kimi K2 0711 : 1 388,8, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- Kimi K2 Thinking : 1 418,0, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- Llama 3.1 70B Instruct : 1 272,6, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- Llama 3.1 8B Instruct : 1 190,9, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- Llama 3.2 1B Instruct : 1 085,7, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- Llama 3.2 3B Instruct : 1 146,1, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- Llama 3.3 70B Instruct : 1 292,6, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- Llama 4 Maverick : 1 313,4, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- Llama 4 Scout : 1 298,9, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- Mercury 2 : 1 323,5, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- MiniMax M1 : 1 346,1, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- MiniMax M2 : 1 337,4, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- MiniMax M2.1 : 1 383,2, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- MiniMax M2.5 : 1 380,2, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- MiniMax M2.7 : 1 406,8, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- Mistral Large : 1 294,6, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- Mistral Large 2407 : 1 299,3, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- Mistral Medium 3 : 1 365,9, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- Mistral Medium 3.1 : 1 395,4, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- Mistral Small 3 : 1 255,3, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- Mistral Small 3.1 24B : 1 293,7, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- Mistral Small 3.2 24B : 1 338,0, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- Mixtral 8x22B Instruct : 1 215,1, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- Nemotron 3 Nano 30B A3B : 1 290,5, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- Nemotron 3 Super : 1 345,1, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- Nemotron 3 Ultra : 1 403,6, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- Nova 2 Lite : 1 327,6, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- Nova Lite 1.0 : 1 243,6, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- Nova Micro 1.0 : 1 214,8, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- Nova Pro 1.0 : 1 276,5, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- Phi 4 : 1 245,4, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- Qwen-Plus : 1 331,8, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- Qwen2.5 72B Instruct : 1 292,0, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- Qwen2.5 Coder 32B Instruct : 1 264,0, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- Qwen3 235B A22B : 1 356,6, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- Qwen3 235B A22B Instruct 2507 : 1 415,4, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- Qwen3 235B A22B Thinking 2507 : 1 385,2, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- Qwen3 30B A3B : 1 310,1, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- Qwen3 30B A3B Instruct 2507 : 1 366,0, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- Qwen3 32B : 1 331,1, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- Qwen3 Next 80B A3B Instruct : 1 376,8, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- Qwen3 Next 80B A3B Thinking : 1 358,8, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- Qwen3 VL 235B A22B Instruct : 1 410,0, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- Qwen3 VL 235B A22B Thinking : 1 382,9, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- Qwen3.5-122B-A10B : 1 406,8, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- Qwen3.5-27B : 1 400,1, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- Qwen3.5-35B-A3B : 1 387,8, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- Qwen3.5-Flash : 1 381,8, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- R1 : 1 397,2, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- R1 0528 : 1 390,7, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- Solar Pro 4 : 1 361,3, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- Step 3.5 Flash : 1 384,9, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- Trinity Large Thinking : 1 358,3, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- gpt-oss-120b : 1 324,1, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- gpt-oss-20b : 1 281,3, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- o3 Mini : 1 343,6, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
- o3 Mini High : 1 366,3, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
126 modèles non mesurés
- Aion-2.0 : 0,81 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Aion-3.0 : 3,04 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Aion-3.0-Mini : 0,71 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Aion-RP 1.0 (8B) : 1,23 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Claude 3 Haiku : 0,28 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Claude Haiku 4.5 : 1,12 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Codestral 2508 : 0,29 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Command R7B (12-2024) : 0,0628 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Cydonia 24B V4.1 : 0,35 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- DeepSeek V4 Flash 0731 : 0,0491 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Devstral 2 2512 : 0,45 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- ERNIE 4.5 VL 424B A47B : 0,67 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Fugu Ultra : 5,93 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- GLM 5 Turbo : 1,28 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- GPT-3.5 Turbo (older v0613) : 1,54 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- GPT-3.5 Turbo 16k : 4,47 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- GPT-3.5 Turbo Instruct : 2,23 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- GPT-4 Turbo : 16,05 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- GPT-4.1 : 2,30 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- GPT-4.1 Mini : 0,46 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- GPT-4.1 Nano : 0,12 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- GPT-4o : 3,32 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- GPT-4o (2024-11-20) : 3,32 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- GPT-4o-mini : 0,20 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- GPT-5 Pro : 29,31 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- GPT-5.1-Codex : 1,66 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- GPT-5.1-Codex-Max : 1,66 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- GPT-5.1-Codex-Mini : 0,33 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- GPT-5.2 Pro : 41,04 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- GPT-5.2-Codex : 2,32 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- GPT-5.3-Codex : 2,32 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- GPT-5.4 Pro : 54,44 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- GPT-5.5 Pro : 54,44 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- GPT-5.6 Luna Pro : 0,24 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- GPT-5.6 Sol Pro : 2,23 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- GPT-5.6 Terra Pro : 2,37 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Gemini 2.5 Pro Preview 06-05 : 1,66 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Gemini 3.1 Flash Lite : 0,30 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Gemini 3.1 Pro Preview Custom Tools : 2,37 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Granite 4.0 Micro : 0,0315 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Grok Build 0.1 : 0,98 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Hermes 3 405B Instruct : 1,47 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Hermes 3 70B Instruct : 1,03 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Hermes 4 405B : 1,61 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Hunyuan A13B Instruct : 0,24 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- KAT-Coder-Pro V2.5 : 0,83 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Kimi K2 0905 : 1,01 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Kimi K2.7 Code : 0,81 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Laguna XS 2.1 : 0,0712 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Ling 3.0 Flash : 0,022 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Llama 3 8B Lunaris : 0,0593 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Llama 3.1 Euryale 70B v2.2 : 1,25 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Llama 3.3 Euryale 70B : 0,96 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Llama Guard 4 12B : 0,26 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- LongCat 2.0 : 0,30 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Magnum v4 72B : 3,84 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- MiniMax M2-her : 0,48 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- MiniMax-01 : 0,36 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Ministral 3 14B 2512 : 0,17 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Ministral 3 3B 2512 : 0,0837 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Ministral 3 8B 2512 : 0,13 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Mistral Nemo : 0,0272 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Mistral Small 4 : 0,16 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Morph V3 Fast : 1,20 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Morph V3 Large : 1,39 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- MythoMax 13B : 0,12 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Nemotron 3.5 Content Safety : 0,29 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Nova Premier 1.0 : 3,05 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Palmyra X5 : 2,09 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Perceptron Mk1 : 0,31 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Qwen Plus 0728 : 0,42 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Qwen2.5 7B Instruct : 0,15 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Qwen2.5 VL 72B Instruct : 0,91 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Qwen3 14B : 0,18 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Qwen3 30B A3B Thinking 2507 : 0,45 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Qwen3 8B : 0,20 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Qwen3 Coder 30B A3B Instruct : 0,12 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Qwen3 Coder 480B A35B : 0,35 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Qwen3 Coder Flash : 0,23 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Qwen3 Coder Next : 0,19 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Qwen3 Coder Plus : 0,77 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Qwen3 Max Thinking : 1,36 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Qwen3 VL 30B A3B Instruct : 0,22 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Qwen3 VL 30B A3B Thinking : 0,45 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Qwen3 VL 32B Instruct : 0,17 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Qwen3 VL 8B Instruct : 0,20 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Qwen3 VL 8B Thinking : 0,40 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Qwen3.5 Plus 2026-02-15 : 0,47 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Qwen3.5 Plus 2026-04-20 : 0,54 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Qwen3.5-9B : 0,15 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Qwen3.6 27B : 0,37 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Qwen3.6 35B A3B : 0,17 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Qwen3.6 Flash : 0,34 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Qwen3.7 Flash : 0,0342 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- R1 Distill Llama 70B : 1,17 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- ReMM SLERP 13B : 0,53 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Reka Edge : 0,15 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Reka Flash 3 : 0,15 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Relace Apply 3 : 1,27 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Relace Search : 1,61 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Saba : 0,20 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Seed 1.6 : 0,49 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Seed 1.6 Flash : 0,13 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Seed-2.0-Lite : 0,49 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Seed-2.0-Mini : 0,17 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Skyfall 36B V2 : 0,61 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Solar Pro 3 : 0,16 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Sonar : 1,47 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Sonar Deep Research : 3,35 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Sonar Pro : 5,23 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Sonar Pro Search : 5,23 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Sonar Reasoning Pro : 3,35 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Step 3.7 Flash : 0,20 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- UI-TARS 7B : 0,15 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Uncensored : 0,34 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- UnslopNemo 12B : 0,59 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Voxtral Small 24B 2507 : 0,0977 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Weaver (alpha) : 0,61 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- WizardLM-2 8x22B : 0,91 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- gpt-oss-safeguard-20b : 0,0995 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- o1 : 19,89 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- o1-pro : 251,24 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- o3 : 2,30 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- o3 Pro : 33,50 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- o4 Mini : 1,27 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- o4 Mini High : 1,27 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
14 modèles moins chers que Peut faire le job ne sont pas mesurés sur ce que cette tâche exige.
43 modèles récents, pas encore mesurés
- Claude Fable 5.1 : 10,64 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Claude Opus 5.5 : 4,33 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Command A+ : 0,42 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- DeepSeek V4 Flash Vision Exp : 0,20 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- DeepSeek V4 Pro 0813 : 0,37 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- DeepSeek V4.1 Flash : 0,13 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Fugu Max : 1,99 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Fugu Ultra v2 : 5,93 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- GLM 5.3 FlashX : 0,40 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- GPT-6 Astra : 11,17 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- GPT-6 Astra Pro : 11,17 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- GPT-6 Luna : 0,11 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- GPT-6 Luna Pro : 0,11 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- GPT-6 Sol : 2,23 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- GPT-6 Sol Pro : 2,23 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Gemini 3.8 Flash : 0,84 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Grok 4.7 : 1,73 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Hy-MT2-1.8B : 0,0738 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Hy-MT2-30B-A3B : 0,12 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Hy-MT2-7B : 0,12 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Hy4 preview : 0,79 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Ling 3.0 Flash VL : 0,0628 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Mercury 2.5 : 0,0412 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- MiMo-V2.6-Flash : 0,12 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- MiMo-V2.6-Pro : 0,37 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- MiMo-V2.6-Pro-UltraSpeed : 3,67 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Muse Spark 1.2 Contributor : 0,0851 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Muse Spark 1.3 : 1,27 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Muse Spark 1.3 Contributor : 0,0851 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Nemotron 3.5 Lightning : 0,0907 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Nex-N2.5-Mini : 0,0262 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Nex-N2.5-Pro : 0,0803 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Pareto : 2,44 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Qwen3.8 2.4T A95B : 1,99 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Qwen3.8 Flash : 0,15 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Qwen3.8 Max (0902) : 1,99 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Qwen3.8 Omni Flash : 0,15 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Sakana Namazu : 1,05 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Schematron V2 Small : 0,0858 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Schematron V2 Turbo : 0,0523 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Seed 2.1 Turbo : 0,87 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Seed-2.0-Code : 0,91 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
- Solar Mini 4 : 0,0523 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style