Tâches / Coder

Coder.

Écrire, corriger ou expliquer du code.

Les recommandations WoBench reposent sur des évaluations humaines.

Mis à jour le 23 septembre 2026 à 16h45
321 modèles évalués
méthode, version 1

Développeur seul. 20 000 tokens en entrée et 3 000 en sortie par exécution

Verdicts rendus parmi les 152 modèles mesurés sur ce que cette tâche exige, sur 321 au banc. Les 169 autres

63 modèles au niveau sur 152 mesurés, 321 au banc.

montants convertis au taux de la Banque centrale européenne du 23 septembre 2026

Peut faire le job
le choix économique qui couvre le besoin
Google
Mesure principale
préférence humaine, LMArena Text, prompts de code, contrôle de style
1 465,6 à 1 496,0 · barre 1 483,9 60e sur 152 mesurés sur cette tâche
99e sur 397 chez préférence humaine, LMArena Text, prompts de code, contrôle de style
fourchette publiée par la source · 1 377 votes
égalité jugée sur les intervalles publiés par la source
Peu de votes : sa fourchette est nettement plus large que celle des autres modèles mesurés.

Barre 1 483,9, la borne basse de sa fourchette : c'est elle qui coupe. Le segment est la fourchette de ce modèle : il est au niveau dès que sa borne haute atteint celle de la barre. Le meilleur de la tâche est à 1 544,9, sa note garantie.

Barre de la mesure, borne basse : 1 483,9. Fourchette 1 483,9 à 1 497,2, posée le 23 septembre 2026 sur 152 modèles, inchangée depuis.

Seconde mesure, conduite d'un terminal, Terminal-Bench relayé par Epoch AI : non mesuré, elle n'ordonne rien ici.
sous la barre sur préférence humaine, LMArena Text, prompts de code, contrôle de style
0,39 €
par mois,
à 300 exécutions
chez Darkbloom
Pourquoi lui

173 fois moins cher que Le meilleur. 9 modèles moins chers n'atteignent pas la barre.

Meilleur compromis
le meilleur équilibre entre performance et coût
Z.ai
Mesure principale
préférence humaine, LMArena Text, prompts de code, contrôle de style
1 513,2 à 1 537,0 · barre 1 483,9 12e sur 152 mesurés sur cette tâche
20e sur 397 chez préférence humaine, LMArena Text, prompts de code, contrôle de style
fourchette publiée par la source · 2 755 votes
égalité jugée sur les intervalles publiés par la source

Barre 1 483,9, la borne basse de sa fourchette : c'est elle qui coupe. Le segment est la fourchette de ce modèle : il est au niveau dès que sa borne haute atteint celle de la barre. Le meilleur de la tâche est à 1 544,9, sa note garantie.

Barre de la mesure, borne basse : 1 483,9. Fourchette 1 483,9 à 1 497,2, posée le 23 septembre 2026 sur 152 modèles, inchangée depuis.

Seconde mesure, conduite d'un terminal, Terminal-Bench relayé par Epoch AI : non mesuré, elle n'ordonne rien ici.
au niveau de la barre sur préférence humaine, LMArena Text, prompts de code, contrôle de style
0,52 €
par mois,
à 300 exécutions
chez Morph
Pourquoi lui

99 % moins cher que Le meilleur, 27,3 points de mesure en moins.

Le meilleur
le modèle le plus performant, indépendamment du prix
Anthropic
Mesure principale
préférence humaine, LMArena Text, prompts de code, contrôle de style
1 544,9 à 1 559,8 · barre 1 483,9 1er sur 152 mesurés sur cette tâche
1er sur 397 chez préférence humaine, LMArena Text, prompts de code, contrôle de style
fourchette publiée par la source · 8 040 votes
égalité jugée sur les intervalles publiés par la source

Barre 1 483,9, la borne basse de sa fourchette : c'est elle qui coupe. Le segment est la fourchette de ce modèle : il est au niveau dès que sa borne haute atteint celle de la barre. Le meilleur de la tâche est à 1 544,9, sa note garantie.

Barre de la mesure, borne basse : 1 483,9. Fourchette 1 483,9 à 1 497,2, posée le 23 septembre 2026 sur 152 modèles, inchangée depuis.

Seconde mesure, conduite d'un terminal, Terminal-Bench relayé par Epoch AI : non mesuré, elle n'ordonne rien ici.
au niveau de la barre sur préférence humaine, LMArena Text, prompts de code, contrôle de style
68,36 €
par mois,
à 300 exécutions
chez Claude Platform on AWS
Pourquoi lui

1er sur les 152 modèles que cette tâche juge. 173 fois le prix de Peut faire le job, pour 71,6 points de mesure en plus.

4 autres modèles sont statistiquement indiscernables de celui ci sur préférence humaine, LMArena Text, prompts de code, contrôle de style : ces écarts existent, ils ne sont pas mesurables. La liste complète de la page les situe.

63 modèles sur 152 font le job sur Coder. Le moins cher coûte 0,39 € par mois.

Le meilleur en coûte 68,36 €. Entre les deux, 61 autres, et voici où ils tombent.

Un point par modèle. le moins cher qui fait le job le meilleur compromis le meilleur Prix réels, échelle adaptée aux grands écarts

Voir Coder dans le spectre complet

Arrivés au niveau

Au niveau, et notés pour la première fois depuis moins de 45 jours. Ils sont jugés comme les autres dès leur première note : leur note repose simplement sur moins de votes.

Voir ce qui a changé

Cette tâche exige une note d'au moins 1 490,6 sur préférence humaine, LMArena Text, prompts de code, contrôle de style. Cette barre appartient à la mesure, elle ne bouge pas, et toutes les tâches qui lisent cette mesure exigent la même : c'est la note du modèle qui la franchit, donc le doute lui profite.

Comment ce verdict est calculé

Le seuil de cette tâche

préférence humaine, LMArena Text, prompts de code, contrôle de style

Barre de la mesure, borne basse : 1 483,9. Fourchette 1 483,9 à 1 497,2, posée le 23 septembre 2026 sur 152 modèles, inchangée depuis.

Seconde mesure : conduite d'un terminal, Terminal-Bench relayé par Epoch AI

Barrières

Aucune barrière : la présence dans la mesure vaut capacité.

Coût mensuel = entrée hors cache × prix d'entrée + entrée en cache × prix du cache + sortie × prix de sortie. L'écriture de cache est exclue en V1.

Sources de cette page

D'où viennent ces chiffres

Prix relevés une fois par jour, à 3h00 (heure de Paris). Licences, attributions et modifications

Ces chiffres viennent des sources publiques citées et reflètent le dernier import, pas l'état à la seconde. Les tarifs sont ceux publiés par les fournisseurs et peuvent changer sans préavis : vérifiez les chez eux avant de vous engager. Nos verdicts orientent un choix, ils ne le garantissent pas : à vous de tester le modèle sur vos propres cas et de valider votre calcul, y compris économique. Notre méthode

Le badge de ce verdict

Collez cet extrait sur votre site. Le badge se met à jour tout seul. Dès que le modèle ne tient plus le verdict, il n'affiche plus que la date de sa dernière vérification : nous ne laissons jamais un verdict périmé chez un tiers.

Le badge de ce verdict

Tous les modèles mesurés

Le classement entier sur préférence humaine, LMArena Text, prompts de code, contrôle de style, du meilleur au moins bon, avec la barre à sa place. La note garantie est la borne basse de la fourchette publiée : c'est elle qui décide de l'élection.

La barre vaut 1 490,6, sa fourchette va de 1 483,9 à 1 497,2, et c'est sa borne basse, 1 483,9, qui coupe. Elle a été posée le 23 septembre 2026 sur 152 modèles, et n'a pas bougé depuis.

Rang Modèle Note Fourchette Coût mensuel Sort
1 Claude Fable 5
Anthropic
1 552,4 1 544,9 à 1 559,8 68,36 € Le meilleur
2 Claude Opus 4.7
Anthropic
1 547,3 1 541,3 à 1 553,3 34,18 € retenu
3 Claude Opus 4.6
Anthropic
1 546,2 1 540,7 à 1 551,7 34,18 € retenu
4 Kimi K3
Moonshot AI
1 538,4 1 529,9 à 1 547,0 14,35 € retenu
5 Muse Spark 1.2
Meta
1 535,6 1 515,8 à 1 555,4 7,03 € retenu
6 Muse Spark 1.1
Meta
1 531,2 1 523,8 à 1 538,7 7,03 € retenu
7 Claude Opus 4.5
Anthropic
1 530,2 1 522,8 à 1 537,5 73,61 € retenu
8 Claude Opus 4.8
Anthropic
1 529,7 1 523,5 à 1 535,9 34,18 € retenu
9 Claude Sonnet 4.6
Anthropic
1 528,3 1 522,6 à 1 534,1 20,51 € retenu
10 GPT-5.6 Sol
OpenAI
1 527,9 1 520,3 à 1 535,6 29,45 € retenu
11 Claude Opus 5
Anthropic
1 525,9 1 517,1 à 1 534,7 34,18 € retenu
12 GLM 5.3 Flash première note
Z.ai
1 525,1 1 513,2 à 1 537,0 0,52 € Meilleur compromis
13 Qwen3.7 Max
Qwen
1 524,7 1 506,2 à 1 543,1 8,14 € retenu
14 GLM 5.3 première note
Z.ai
1 524,0 1 512,4 à 1 535,6 3,14 € retenu
15 MiMo-V2.5-Pro
Xiaomi
1 520,9 1 515,0 à 1 526,9 1,29 € retenu
16 Gemini 3.7 Flash première note
Google
1 520,6 1 505,8 à 1 535,4 11,04 € retenu
17 Claude Sonnet 5
Anthropic
1 520,5 1 513,5 à 1 527,5 29,45 € retenu
18 Gemini 3.1 Pro Preview préversion
Google
1 520,2 1 515,3 à 1 525,0 15,25 € retenu
19 Claude Sonnet 4.5
Anthropic
1 519,6 1 514,6 à 1 524,5 44,17 € retenu
20 Grok 4.5
xAI
1 518,5 1 511,1 à 1 525,8 10,78 € retenu
21 GPT-5.6 Terra
OpenAI
1 517,9 1 510,4 à 1 525,5 34,18 € retenu
22 Gemini 3.6 Flash
Google
1 517,2 1 509,7 à 1 524,7 11,04 € retenu
23 GPT-5.2 Chat
OpenAI
1 514,9 1 507,9 à 1 521,8 16,10 € retenu
24 Kimi K2.6
Moonshot AI
1 514,0 1 507,0 à 1 521,0 3,69 € retenu
25 GPT-5.4
OpenAI
1 513,4 1 507,4 à 1 519,3 19,06 € retenu
26 GLM 5.1
Z.ai
1 512,6 1 506,5 à 1 518,6 5,26 € retenu
27 Claude Opus 4.1
Anthropic
1 512,4 1 505,9 à 1 518,9 102,53 € retenu
28 Grok 4.20
xAI
1 510,3 1 504,4 à 1 516,2 5,78 € retenu
29 GLM 5.2
Z.ai
1 509,8 1 502,9 à 1 516,7 3,14 € retenu
30 Qwen3.6 Max Preview préversion
Qwen
1 508,7 1 493,2 à 1 524,2 10,26 € retenu
31 GPT-5.5
OpenAI
1 508,6 1 502,9 à 1 514,4 38,12 € retenu
32 Grok 4.20 Multi-Agent
xAI
1 507,8 1 502,0 à 1 513,7 5,78 € retenu
33 Gemini 3 Flash Preview préversion
Google
1 507,3 1 499,4 à 1 515,2 3,81 € retenu
34 Grok 4.6 première note
xAI
1 506,1 1 496,3 à 1 515,9 20,77 € retenu
35 Kimi K2.5
Moonshot AI
1 505,2 1 491,3 à 1 519,2 4,00 € retenu
36 Gemini 3.5 Flash Lite
Google
1 503,8 1 496,0 à 1 511,6 2,84 € retenu
37 Hy3
Tencent
1 502,7 1 490,0 à 1 515,3 0,85 € retenu
38 Gemini 3.5 Flash
Google
1 502,4 1 495,6 à 1 509,2 11,44 € retenu
39 DeepSeek V4 Pro 0423
DeepSeek
1 501,5 1 495,4 à 1 507,6 4,23 € retenu
40 Qwen3.7 Plus
Qwen
1 501,0 1 494,5 à 1 507,6 2,02 € retenu
41 Qwen3.8 27B première note
Qwen
1 499,1 1 488,1 à 1 510,0 1,97 € retenu
42 Gemma 4 31B
Google
1 498,8 1 483,4 à 1 514,1 0,64 € retenu
43 GPT-5.6 Luna
OpenAI
1 497,7 1 490,2 à 1 505,2 3,42 € retenu
44 GLM 5
Z.ai
1 497,5 1 490,1 à 1 504,9 3,41 € retenu
45 MiniMax M3
MiniMax
1 496,3 1 490,0 à 1 502,5 1,51 € retenu
46 GPT-5.4 Mini
OpenAI
1 496,0 1 490,0 à 1 502,0 12,82 € retenu
47 Qwen3.6 Plus
Qwen
1 494,7 1 488,3 à 1 501,2 3,25 € retenu
48 Inkling
Thinking Machines
1 492,0 1 484,3 à 1 499,7 6,11 € retenu
49 Qwen3.5 397B A17B
Qwen
1 490,7 1 485,6 à 1 495,9 3,90 € retenu
50 MiMo-V2.5
Xiaomi
1 490,6 1 483,9 à 1 497,2 0,51 € retenu
51 GLM 5V Turbo
Z.ai
1 489,1 1 477,2 à 1 501,0 6,94 € retenu
52 Grok 4.3
xAI
1 487,8 1 482,1 à 1 493,6 5,78 € retenu
53 Kimi K2 Thinking
Moonshot AI
1 486,5 1 481,0 à 1 492,0 3,94 € retenu
54 GLM 4.7
Z.ai
1 485,2 1 473,1 à 1 497,3 3,14 € retenu
55 DeepSeek V4 Flash 0423
DeepSeek
1 483,1 1 476,7 à 1 489,4 0,41 € retenu
56 Muse Glimmer 30B
Meta
1 482,7 1 464,1 à 1 501,3 1,76 € retenu
57 GPT-5.2
OpenAI
1 482,2 1 477,0 à 1 487,5 16,10 € retenu
58 Qwen3 Max
Qwen
1 481,1 1 472,7 à 1 489,4 5,54 € retenu
59 MiniMax M2.7
MiniMax
1 480,9 1 475,4 à 1 486,3 1,33 € retenu
60 Gemma 4 26B A4B
Google
1 480,8 1 465,6 à 1 496,0 0,39 € Peut faire le job
61 Mistral Medium 3.5
Mistral
1 478,8 1 467,7 à 1 490,0 13,80 € retenu
La coupure : un modèle est au niveau quand sa borne haute atteint 1 483,9. Au dessus, les modèles au niveau ; en dessous, les autres.
62 DeepSeek V3.2
DeepSeek
1 475,8 1 468,9 à 1 482,6 0,85 € sous la barre
63 GPT-5.1
OpenAI
1 474,9 1 468,2 à 1 481,7 11,50 € sous la barre
64 Nemotron 3 Ultra
NVIDIA
1 474,5 1 463,1 à 1 485,9 4,60 € retenu
65 Inkling Small
Thinking Machines
1 474,2 1 465,5 à 1 482,9 2,39 € sous la barre
66 Claude Sonnet 4
Anthropic
1 473,4 1 465,6 à 1 481,3 20,51 € sous la barre
67 Qwen3 235B A22B Instruct 2507
Qwen
1 472,2 1 467,6 à 1 476,8 0,55 € sous la barre
68 GPT-5
OpenAI
1 470,2 1 462,1 à 1 478,3 27,28 € sous la barre
69 Kimi K2 0711
Moonshot AI
1 467,0 1 454,3 à 1 479,6 4,81 € sous la barre
70 Gemini 2.5 Pro
Google
1 465,0 1 460,7 à 1 469,3 11,50 € sous la barre
71 DeepSeek V3.2 Exp
DeepSeek
1 464,9 1 453,2 à 1 476,7 1,74 € sous la barre
72 Qwen3 VL 235B A22B Instruct
Qwen
1 464,6 1 451,6 à 1 477,7 1,51 € sous la barre
73 R1 0528
DeepSeek
1 464,0 1 452,6 à 1 475,3 4,35 € sous la barre
74 DeepSeek V3.1 Terminus
DeepSeek
1 461,2 1 437,6 à 1 484,8 1,85 € retenu
75 Hy3 preview préversion
Tencent
1 460,2 1 446,5 à 1 473,9 1,10 € sous la barre
76 GPT-5.4 Nano
OpenAI
1 459,6 1 453,6 à 1 465,7 3,54 € sous la barre
77 Qwen3.5-122B-A10B
Qwen
1 459,2 1 451,9 à 1 466,5 3,01 € sous la barre
78 GLM 4.6
Z.ai
1 457,8 1 450,5 à 1 465,0 3,47 € sous la barre
79 Gemini 3.1 Flash Lite Preview préversion
Google
1 456,9 1 451,0 à 1 462,7 1,91 € sous la barre
80 DeepSeek V3.1
DeepSeek
1 455,8 1 442,3 à 1 469,3 1,85 € sous la barre
81 GLM 4.5
Z.ai
1 454,6 1 445,8 à 1 463,4 3,60 € sous la barre
82 Mistral Medium 3.1
Mistral
1 454,3 1 449,7 à 1 459,0 2,73 € sous la barre
83 Qwen3 VL 235B A22B Thinking
Qwen
1 453,3 1 438,9 à 1 467,8 5,26 € sous la barre
84 Step 3.5 Flash
StepFun
1 450,2 1 444,4 à 1 456,0 0,76 € sous la barre
85 Qwen3.5-27B
Qwen
1 450,1 1 442,7 à 1 457,4 2,26 € sous la barre
86 Solar Pro 4 première note
Upstage
1 449,0 1 426,3 à 1 471,7 0,57 € sous la barre
87 Qwen3 Next 80B A3B Instruct
Qwen
1 444,6 1 435,9 à 1 453,3 1,13 € sous la barre
88 R1
DeepSeek
1 444,5 1 432,6 à 1 456,3 5,65 € sous la barre
89 MiniMax M2.5
MiniMax
1 444,3 1 437,8 à 1 450,9 1,54 € sous la barre
90 Qwen3 235B A22B Thinking 2507
Qwen
1 442,4 1 427,7 à 1 457,1 3,02 € sous la barre
91 Qwen3 30B A3B Instruct 2507
Qwen
1 438,8 1 429,9 à 1 447,6 0,41 € sous la barre
92 MiniMax M2.1
MiniMax
1 438,4 1 428,2 à 1 448,6 1,81 € sous la barre
93 Qwen3.5-Flash
Qwen
1 437,0 1 431,2 à 1 442,8 0,55 € sous la barre
94 Qwen3.5-35B-A3B
Qwen
1 434,7 1 427,5 à 1 442,0 1,29 € sous la barre
95 o3 Mini High
OpenAI
1 434,7 1 423,2 à 1 446,3 14,75 € sous la barre
96 Mistral Medium 3
Mistral
1 433,1 1 425,0 à 1 441,1 2,73 € sous la barre
97 Qwen3 235B A22B
Qwen
1 432,3 1 423,3 à 1 441,3 3,83 € sous la barre
98 GPT-5 Mini
OpenAI
1 430,8 1 422,3 à 1 439,3 5,46 € sous la barre
99 DeepSeek V3 0324
DeepSeek
1 428,7 1 421,9 à 1 435,5 1,95 € sous la barre
100 GLM 4.5 Air
Z.ai
1 427,1 1 419,3 à 1 434,8 1,08 € sous la barre
101 GLM 4.7 Flash
Z.ai
1 425,5 1 414,3 à 1 436,7 0,50 € sous la barre
102 Gemini 2.5 Flash
Google
1 423,5 1 419,2 à 1 427,9 2,84 € sous la barre
103 Qwen3 Next 80B A3B Thinking
Qwen
1 421,6 1 410,1 à 1 433,1 1,74 € sous la barre
104 o3 Mini
OpenAI
1 416,7 1 410,2 à 1 423,1 7,81 € sous la barre
105 MiniMax M1
MiniMax
1 416,3 1 408,6 à 1 424,0 3,84 € sous la barre
106 GLM 4.6V
Z.ai
1 416,3 1 391,1 à 1 441,5 1,63 € sous la barre
107 Trinity Large Thinking
Arcee AI
1 414,0 1 406,5 à 1 421,6 1,45 € sous la barre
108 Mistral Small 3.2 24B
Mistral
1 412,4 1 402,4 à 1 422,5 0,55 € sous la barre
109 Nemotron 3 Super
NVIDIA
1 408,3 1 394,5 à 1 422,0 0,76 € sous la barre
110 Qwen3 32B
Qwen
1 406,8 1 382,5 à 1 431,1 0,64 € sous la barre
111 GLM 4.5V
Z.ai
1 403,7 1 385,0 à 1 422,3 3,29 € sous la barre
112 Nova 2 Lite
Amazon
1 394,1 1 382,2 à 1 405,9 3,55 € sous la barre
113 Mercury 2
Inception
1 393,5 1 372,5 à 1 414,4 1,31 € sous la barre
114 gpt-oss-120b
OpenAI
1 390,6 1 382,8 à 1 398,3 0,29 € sous la barre
115 Command A
Cohere
1 389,2 1 383,0 à 1 395,4 21,03 € sous la barre
116 DeepSeek V3
DeepSeek
1 387,4 1 377,3 à 1 397,5 2,16 € sous la barre
117 Qwen3 30B A3B
Qwen
1 385,9 1 377,0 à 1 394,7 1,03 € sous la barre
118 GPT-5 Nano
OpenAI
1 384,4 1 369,8 à 1 399,1 1,09 € sous la barre
119 Gemini 2.5 Flash Lite
Google
1 383,0 1 374,9 à 1 391,0 0,60 € sous la barre
120 MiniMax M2
MiniMax
1 382,9 1 367,7 à 1 398,2 1,81 € sous la barre
121 Qwen-Plus
Qwen
1 379,3 1 360,9 à 1 397,7 1,44 € sous la barre
122 Llama 4 Maverick
Meta
1 372,8 1 365,3 à 1 380,3 1,50 € sous la barre
123 GPT-4o (2024-05-13)
OpenAI
1 369,3 1 362,9 à 1 375,8 38,12 € sous la barre
124 gpt-oss-20b
OpenAI
1 369,2 1 356,1 à 1 382,2 0,17 € sous la barre
125 Llama 4 Scout
Meta
1 362,3 1 353,8 à 1 370,9 0,76 € sous la barre
126 Granite 4.2 8B première note
IBM
1 362,2 1 340,2 à 1 384,2 0,39 € sous la barre
127 Mistral Small 3.1 24B
Mistral
1 361,5 1 353,6 à 1 369,5 2,28 € sous la barre
128 Nemotron 3 Nano 30B A3B
NVIDIA
1 360,5 1 350,1 à 1 370,9 0,37 € sous la barre
129 GPT-4o (2024-08-06)
OpenAI
1 360,3 1 352,4 à 1 368,2 17,75 € sous la barre
130 Gemma 3 27B
Google
1 357,8 1 350,9 à 1 364,8 0,55 € sous la barre
131 Qwen2.5 72B Instruct
Qwen
1 355,4 1 347,7 à 1 363,1 2,21 € sous la barre
132 Mistral Large 2407
Mistral
1 353,9 1 346,0 à 1 361,8 10,52 € sous la barre
133 GPT-4o-mini (2024-07-18)
OpenAI
1 348,4 1 341,8 à 1 354,9 1,06 € sous la barre
134 Mistral Large
Mistral
1 346,2 1 337,3 à 1 355,0 10,52 € sous la barre
135 Llama 3.3 70B Instruct
Meta
1 345,9 1 339,4 à 1 352,5 0,78 € sous la barre
136 Nova Pro 1.0
Amazon
1 343,0 1 333,9 à 1 352,2 6,73 € sous la barre
137 Qwen2.5 Coder 32B Instruct
Qwen
1 342,3 1 323,8 à 1 360,8 4,26 € sous la barre
138 Llama 3.1 70B Instruct
Meta
1 333,4 1 326,2 à 1 340,5 2,42 € sous la barre
139 GPT-4
OpenAI
1 329,8 1 320,5 à 1 339,2 205,07 € sous la barre
140 Gemma 3 12B
Google
1 316,2 1 292,8 à 1 339,5 0,38 € sous la barre
141 Mistral Small 3
Mistral
1 312,4 1 299,9 à 1 324,9 0,33 € sous la barre
142 Phi 4
Microsoft
1 306,3 1 296,4 à 1 316,2 0,48 € sous la barre
143 Nova Lite 1.0
Amazon
1 305,9 1 295,5 à 1 316,2 0,50 € sous la barre
144 Nova Micro 1.0
Amazon
1 288,6 1 278,3 à 1 299,0 0,29 € sous la barre
145 Command R (08-2024)
Cohere
1 281,5 1 268,0 à 1 295,0 1,26 € sous la barre
146 Command R+ (08-2024)
Cohere
1 280,3 1 266,5 à 1 294,2 21,03 € sous la barre
147 Mixtral 8x22B Instruct
Mistral
1 277,6 1 269,0 à 1 286,3 10,52 € sous la barre
148 GPT-3.5 Turbo
OpenAI
1 275,0 1 266,9 à 1 283,1 3,81 € sous la barre
149 Gemma 3 4B
Google
1 273,8 1 250,2 à 1 297,5 0,34 € sous la barre
150 Llama 3.1 8B Instruct
Meta
1 259,8 1 252,3 à 1 267,3 0,14 € sous la barre
151 Llama 3.2 3B Instruct
Meta
1 176,6 1 160,2 à 1 192,9 0,52 € sous la barre
152 Llama 3.2 1B Instruct
Meta
1 149,3 1 133,0 à 1 165,6 0,30 € sous la barre

Ce que devient le banc sur cette tâche

Les cinq populations forment une partition du banc : leur somme vaut le nombre de modèles au banc, sur chaque tâche, à chaque calcul.

0 modèle écarté par une barrière

aucun

63 modèles mesurés et éligibles
  • Claude Fable 5
  • Claude Opus 4.1
  • Claude Opus 4.5
  • Claude Opus 4.6
  • Claude Opus 4.7
  • Claude Opus 4.8
  • Claude Opus 5
  • Claude Sonnet 4.5
  • Claude Sonnet 4.6
  • Claude Sonnet 5
  • DeepSeek V3.1 Terminus
  • DeepSeek V4 Flash 0423
  • DeepSeek V4 Pro 0423
  • GLM 4.7
  • GLM 5
  • GLM 5.1
  • GLM 5.2
  • GLM 5.3
  • GLM 5.3 Flash
  • GLM 5V Turbo
  • GPT-5.2
  • GPT-5.2 Chat
  • GPT-5.4
  • GPT-5.4 Mini
  • GPT-5.5
  • GPT-5.6 Luna
  • GPT-5.6 Sol
  • GPT-5.6 Terra
  • Gemini 3 Flash Preview
  • Gemini 3.1 Pro Preview
  • Gemini 3.5 Flash
  • Gemini 3.5 Flash Lite
  • Gemini 3.6 Flash
  • Gemini 3.7 Flash
  • Gemma 4 26B A4B
  • Gemma 4 31B
  • Grok 4.20
  • Grok 4.20 Multi-Agent
  • Grok 4.3
  • Grok 4.5
  • Grok 4.6
  • Hy3
  • Inkling
  • Kimi K2 Thinking
  • Kimi K2.5
  • Kimi K2.6
  • Kimi K3
  • MiMo-V2.5
  • MiMo-V2.5-Pro
  • MiniMax M2.7
  • MiniMax M3
  • Mistral Medium 3.5
  • Muse Glimmer 30B
  • Muse Spark 1.1
  • Muse Spark 1.2
  • Nemotron 3 Ultra
  • Qwen3 Max
  • Qwen3.5 397B A17B
  • Qwen3.6 Max Preview
  • Qwen3.6 Plus
  • Qwen3.7 Max
  • Qwen3.7 Plus
  • Qwen3.8 27B
89 modèles mesurés sous le seuil
  • Claude Sonnet 4 : 1 473,4, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • Command A : 1 389,2, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • Command R (08-2024) : 1 281,5, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • Command R+ (08-2024) : 1 280,3, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • DeepSeek V3 : 1 387,4, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • DeepSeek V3 0324 : 1 428,7, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • DeepSeek V3.1 : 1 455,8, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • DeepSeek V3.2 : 1 475,8, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • DeepSeek V3.2 Exp : 1 464,9, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • GLM 4.5 : 1 454,6, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • GLM 4.5 Air : 1 427,1, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • GLM 4.5V : 1 403,7, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • GLM 4.6 : 1 457,8, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • GLM 4.6V : 1 416,3, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • GLM 4.7 Flash : 1 425,5, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • GPT-3.5 Turbo : 1 275,0, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • GPT-4 : 1 329,8, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • GPT-4o (2024-05-13) : 1 369,3, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • GPT-4o (2024-08-06) : 1 360,3, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • GPT-4o-mini (2024-07-18) : 1 348,4, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • GPT-5 : 1 470,2, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • GPT-5 Mini : 1 430,8, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • GPT-5 Nano : 1 384,4, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • GPT-5.1 : 1 474,9, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • GPT-5.4 Nano : 1 459,6, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • Gemini 2.5 Flash : 1 423,5, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • Gemini 2.5 Flash Lite : 1 383,0, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • Gemini 2.5 Pro : 1 465,0, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • Gemini 3.1 Flash Lite Preview : 1 456,9, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • Gemma 3 12B : 1 316,2, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • Gemma 3 27B : 1 357,8, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • Gemma 3 4B : 1 273,8, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • Granite 4.2 8B : 1 362,2, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • Hy3 preview : 1 460,2, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • Inkling Small : 1 474,2, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • Kimi K2 0711 : 1 467,0, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • Llama 3.1 70B Instruct : 1 333,4, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • Llama 3.1 8B Instruct : 1 259,8, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • Llama 3.2 1B Instruct : 1 149,3, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • Llama 3.2 3B Instruct : 1 176,6, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • Llama 3.3 70B Instruct : 1 345,9, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • Llama 4 Maverick : 1 372,8, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • Llama 4 Scout : 1 362,3, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • Mercury 2 : 1 393,5, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • MiniMax M1 : 1 416,3, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • MiniMax M2 : 1 382,9, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • MiniMax M2.1 : 1 438,4, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • MiniMax M2.5 : 1 444,3, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • Mistral Large : 1 346,2, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • Mistral Large 2407 : 1 353,9, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • Mistral Medium 3 : 1 433,1, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • Mistral Medium 3.1 : 1 454,3, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • Mistral Small 3 : 1 312,4, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • Mistral Small 3.1 24B : 1 361,5, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • Mistral Small 3.2 24B : 1 412,4, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • Mixtral 8x22B Instruct : 1 277,6, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • Nemotron 3 Nano 30B A3B : 1 360,5, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • Nemotron 3 Super : 1 408,3, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • Nova 2 Lite : 1 394,1, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • Nova Lite 1.0 : 1 305,9, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • Nova Micro 1.0 : 1 288,6, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • Nova Pro 1.0 : 1 343,0, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • Phi 4 : 1 306,3, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • Qwen-Plus : 1 379,3, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • Qwen2.5 72B Instruct : 1 355,4, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • Qwen2.5 Coder 32B Instruct : 1 342,3, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • Qwen3 235B A22B : 1 432,3, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • Qwen3 235B A22B Instruct 2507 : 1 472,2, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • Qwen3 235B A22B Thinking 2507 : 1 442,4, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • Qwen3 30B A3B : 1 385,9, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • Qwen3 30B A3B Instruct 2507 : 1 438,8, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • Qwen3 32B : 1 406,8, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • Qwen3 Next 80B A3B Instruct : 1 444,6, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • Qwen3 Next 80B A3B Thinking : 1 421,6, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • Qwen3 VL 235B A22B Instruct : 1 464,6, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • Qwen3 VL 235B A22B Thinking : 1 453,3, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • Qwen3.5-122B-A10B : 1 459,2, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • Qwen3.5-27B : 1 450,1, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • Qwen3.5-35B-A3B : 1 434,7, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • Qwen3.5-Flash : 1 437,0, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • R1 : 1 444,5, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • R1 0528 : 1 464,0, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • Solar Pro 4 : 1 449,0, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • Step 3.5 Flash : 1 450,2, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • Trinity Large Thinking : 1 414,0, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • gpt-oss-120b : 1 390,6, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • gpt-oss-20b : 1 369,2, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • o3 Mini : 1 416,7, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
  • o3 Mini High : 1 434,7, sous la barre sur cette mesure, dont la borne basse est à 1 483,9
126 modèles non mesurés
  • Aion-2.0 : 3,89 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Aion-3.0 : 14,59 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Aion-3.0-Mini : 3,42 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Aion-RP 1.0 (8B) : 5,47 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Claude 3 Haiku : 1,72 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Claude Haiku 4.5 : 6,84 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Codestral 2508 : 1,58 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Command R7B (12-2024) : 0,32 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Cydonia 24B V4.1 : 1,58 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • DeepSeek V4 Flash 0731 : 0,27 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Devstral 2 2512 : 2,73 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • ERNIE 4.5 VL 424B A47B : 3,19 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Fugu Ultra : 38,12 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • GLM 5 Turbo : 6,94 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • GPT-3.5 Turbo (older v0613) : 6,84 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • GPT-3.5 Turbo 16k : 18,93 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • GPT-3.5 Turbo Instruct : 9,46 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • GPT-4 Turbo : 76,24 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • GPT-4.1 : 12,88 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • GPT-4.1 Mini : 2,58 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • GPT-4.1 Nano : 0,64 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • GPT-4o : 17,75 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • GPT-4o (2024-11-20) : 17,75 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • GPT-4o-mini : 1,06 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • GPT-5 Pro : 173,52 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • GPT-5.1-Codex : 11,52 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • GPT-5.1-Codex-Max : 11,50 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • GPT-5.1-Codex-Mini : 2,31 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • GPT-5.2 Pro : 242,92 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • GPT-5.2-Codex : 16,10 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • GPT-5.3-Codex : 16,10 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • GPT-5.4 Pro : 299,71 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • GPT-5.5 Pro : 299,71 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • GPT-5.6 Luna Pro : 1,52 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • GPT-5.6 Sol Pro : 13,67 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • GPT-5.6 Terra Pro : 15,25 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Gemini 2.5 Pro Preview 06-05 : 11,50 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Gemini 3.1 Flash Lite : 1,91 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Gemini 3.1 Pro Preview Custom Tools : 15,25 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Granite 4.0 Micro : 0,18 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Grok Build 0.1 : 4,73 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Hermes 3 405B Instruct : 6,05 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Hermes 3 70B Instruct : 4,23 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Hermes 4 405B : 7,62 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Hunyuan A13B Instruct : 1,19 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • KAT-Coder-Pro V2.5 : 4,67 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Kimi K2 0905 : 5,13 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Kimi K2.7 Code : 4,61 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Laguna XS 2.1 : 0,33 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Ling 3.0 Flash : 0,12 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Llama 3 8B Lunaris : 0,25 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Llama 3.1 Euryale 70B v2.2 : 5,14 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Llama 3.3 Euryale 70B : 4,01 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Llama Guard 4 12B : 1,09 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • LongCat 2.0 : 1,75 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Magnum v4 72B : 17,09 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • MiniMax M2-her : 3,71 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • MiniMax-01 : 1,92 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Ministral 3 14B 2512 : 0,74 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Ministral 3 3B 2512 : 0,37 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Ministral 3 8B 2512 : 0,55 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Mistral Nemo : 0,12 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Mistral Small 4 : 0,91 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Morph V3 Fast : 5,15 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Morph V3 Large : 6,23 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • MythoMax 13B : 0,51 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Nemotron 3.5 Content Safety : 1,21 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Nova Premier 1.0 : 18,07 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Palmyra X5 : 17,35 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Perceptron Mk1 : 1,97 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Qwen Plus 0728 : 1,98 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Qwen2.5 7B Instruct : 0,68 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Qwen2.5 VL 72B Instruct : 3,94 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Qwen3 14B : 0,82 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Qwen3 30B A3B Thinking 2507 : 2,94 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Qwen3 8B : 0,97 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Qwen3 Coder 30B A3B Instruct : 0,58 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Qwen3 Coder 480B A35B : 1,84 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Qwen3 Coder Flash : 1,38 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Qwen3 Coder Next : 1,13 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Qwen3 Coder Plus : 4,61 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Qwen3 Max Thinking : 7,18 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Qwen3 VL 30B A3B Instruct : 1,09 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Qwen3 VL 30B A3B Thinking : 2,31 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Qwen3 VL 32B Instruct : 0,87 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Qwen3 VL 8B Instruct : 0,97 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Qwen3 VL 8B Thinking : 2,60 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Qwen3.5 Plus 2026-02-15 : 2,60 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Qwen3.5 Plus 2026-04-20 : 3,00 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Qwen3.5-9B : 0,64 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Qwen3.6 27B : 2,45 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Qwen3.6 35B A3B : 1,10 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Qwen3.6 Flash : 1,87 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Qwen3.7 Flash : 0,20 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • R1 Distill Llama 70B : 4,84 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • ReMM SLERP 13B : 2,35 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Reka Edge : 0,60 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Reka Flash 3 : 0,68 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Relace Apply 3 : 5,46 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Relace Search : 7,62 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Saba : 1,05 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Seed 1.6 : 2,89 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Seed 1.6 Flash : 0,63 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Seed-2.0-Lite : 2,89 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Seed-2.0-Mini : 0,84 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Skyfall 36B V2 : 2,73 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Solar Pro 3 : 0,91 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Sonar : 6,05 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Sonar Deep Research : 16,83 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Sonar Pro : 27,60 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Sonar Pro Search : 27,60 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Sonar Reasoning Pro : 16,83 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Step 3.7 Flash : 1,23 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • UI-TARS 7B : 0,68 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Uncensored : 1,76 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • UnslopNemo 12B : 2,42 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Voxtral Small 24B 2507 : 0,53 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Weaver (alpha) : 2,69 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • WizardLM-2 8x22B : 3,75 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • gpt-oss-safeguard-20b : 0,53 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • o1 : 106,48 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • o1-pro : 1 262 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • o3 : 12,88 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • o3 Pro : 168,26 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • o4 Mini : 7,09 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • o4 Mini High : 7,09 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style

15 modèles moins chers que Peut faire le job ne sont pas mesurés sur ce que cette tâche exige.

43 modèles récents, pas encore mesurés
  • Claude Fable 5.1 : 66,38 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Claude Opus 5.5 : 26,82 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Command A+ : 2,37 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • DeepSeek V4 Flash Vision Exp : 1,09 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • DeepSeek V4 Pro 0813 : 2,03 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • DeepSeek V4.1 Flash : 0,71 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Fugu Max : 10,65 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Fugu Ultra v2 : 38,12 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • GLM 5.3 FlashX : 2,16 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • GPT-6 Astra : 68,36 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • GPT-6 Astra Pro : 68,36 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • GPT-6 Luna : 0,68 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • GPT-6 Luna Pro : 0,68 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • GPT-6 Sol : 13,67 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • GPT-6 Sol Pro : 13,67 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Gemini 3.8 Flash : 5,13 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Grok 4.7 : 9,04 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Hy-MT2-1.8B : 0,37 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Hy-MT2-30B-A3B : 0,62 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Hy-MT2-7B : 0,62 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Hy4 preview : 4,28 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Ling 3.0 Flash VL : 0,33 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Mercury 2.5 : 0,23 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • MiMo-V2.6-Flash : 0,60 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • MiMo-V2.6-Pro : 1,84 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • MiMo-V2.6-Pro-UltraSpeed : 18,39 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Muse Spark 1.2 Contributor : 0,43 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Muse Spark 1.3 : 7,03 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Muse Spark 1.3 Contributor : 0,43 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Nemotron 3.5 Lightning : 0,45 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Nex-N2.5-Mini : 0,15 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Nex-N2.5-Pro : 0,43 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Pareto : 13,15 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Qwen3.8 2.4T A95B : 10,65 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Qwen3.8 Flash : 0,81 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Qwen3.8 Max (0902) : 10,65 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Qwen3.8 Omni Flash : 0,81 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Sakana Namazu : 6,05 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Schematron V2 Small : 0,44 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Schematron V2 Turbo : 0,28 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Seed 2.1 Turbo : 4,60 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Seed-2.0-Code : 5,00 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style
  • Solar Mini 4 : 0,30 € par mois, non mesuré sur préférence humaine, LMArena Text, prompts de code, contrôle de style