Tâches / Trier et extraire

Trier et extraire.

Trier, étiqueter et extraire des données structurées à grand volume.

Les recommandations WoBench reposent sur des évaluations humaines.

Mis à jour le 23 septembre 2026 à 16h45
321 modèles évalués
méthode, version 1

Boîte professionnelle à trier. 800 tokens en entrée et 40 en sortie par exécution

Filtre actif : Hébergement en UE. 127 modèles du banc retirés du calcul, les trois verdicts sont recalculés sur le reste. Retirer le filtre Selon nos vérifications du 6 septembre 2026, saisies à la main fournisseur par fournisseur. Ce n'est pas une garantie.

Verdicts rendus parmi les 106 modèles mesurés sur ce que cette tâche exige, sur 321 au banc. Les 215 autres

52 modèles au niveau sur 106 mesurés, 321 au banc.

montants convertis au taux de la Banque centrale européenne du 23 septembre 2026

Peut faire le job
le choix économique qui couvre le besoin
Google
Mesure principale
préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
1 424,1 à 1 452,0 · barre 1 425,0 39e sur 106 mesurés sur cette tâche
72e sur 402 chez préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
fourchette publiée par la source · 1 628 votes
égalité jugée sur les intervalles publiés par la source
Peu de votes : sa fourchette est nettement plus large que celle des autres modèles mesurés.

Barre 1 425,0, la borne basse de sa fourchette : c'est elle qui coupe. Le segment est la fourchette de ce modèle : il est au niveau dès que sa borne haute atteint celle de la barre. Le meilleur de la tâche est à 1 504,5, sa note garantie.

Barre de la mesure, borne basse : 1 425,0. Fourchette 1 425,0 à 1 437,5, posée le 23 septembre 2026 sur 152 modèles, inchangée depuis.

au niveau de la barre sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
0,0743 €
par mois,
à 2 000 exécutions
chez Darkbloom
Pourquoi lui

151 fois moins cher que Le meilleur. 6 modèles moins chers n'atteignent pas la barre.

Meilleur compromis
le meilleur équilibre entre performance et coût
Z.ai
Mesure principale
préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
1 460,5 à 1 481,2 · barre 1 425,0 15e sur 106 mesurés sur cette tâche
29e sur 402 chez préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
fourchette publiée par la source · 3 554 votes
égalité jugée sur les intervalles publiés par la source
Peu de votes : sa fourchette est nettement plus large que celle des autres modèles mesurés.

Barre 1 425,0, la borne basse de sa fourchette : c'est elle qui coupe. Le segment est la fourchette de ce modèle : il est au niveau dès que sa borne haute atteint celle de la barre. Le meilleur de la tâche est à 1 504,5, sa note garantie.

Barre de la mesure, borne basse : 1 425,0. Fourchette 1 425,0 à 1 437,5, posée le 23 septembre 2026 sur 152 modèles, inchangée depuis.

au niveau de la barre sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
0,0956 €
par mois,
à 2 000 exécutions
chez Morph
Pourquoi lui

99 % moins cher que Le meilleur, 40,5 points de mesure en moins.

Le meilleur
le modèle le plus performant, indépendamment du prix
Anthropic
Mesure principale
préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
1 504,5 à 1 518,0 · barre 1 425,0 1er sur 106 mesurés sur cette tâche
2e sur 402 chez préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
fourchette publiée par la source · 10 641 votes
égalité jugée sur les intervalles publiés par la source

Barre 1 425,0, la borne basse de sa fourchette : c'est elle qui coupe. Le segment est la fourchette de ce modèle : il est au niveau dès que sa borne haute atteint celle de la barre. Le meilleur de la tâche est à 1 504,5, sa note garantie.

Barre de la mesure, borne basse : 1 425,0. Fourchette 1 425,0 à 1 437,5, posée le 23 septembre 2026 sur 152 modèles, inchangée depuis.

au niveau de la barre sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
11,22 €
par mois,
à 2 000 exécutions
chez Claude Platform on AWS
Pourquoi lui

1er sur les 106 modèles que cette tâche juge. 151 fois le prix de Peut faire le job, pour 73,3 points de mesure en plus.

Un autre modèle est statistiquement indiscernable de celui ci sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style : l'écart existe, il n'est pas mesurable. La liste complète de la page les situe.

Le spectre des prix compare tous les modèles au niveau de chaque tâche. Il ne tient pas compte du filtre d'hébergement, il est donc masqué tant que ce filtre est actif.

Arrivés au niveau

Au niveau, et notés pour la première fois depuis moins de 45 jours. Ils sont jugés comme les autres dès leur première note : leur note repose simplement sur moins de votes.

Voir ce qui a changé

Cette tâche exige une note d'au moins 1 431,2 sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style. Cette barre appartient à la mesure, elle ne bouge pas, et toutes les tâches qui lisent cette mesure exigent la même : c'est la note du modèle qui la franchit, donc le doute lui profite.

Comment ce verdict est calculé

Le seuil de cette tâche

préférence humaine, LMArena Text, suivi d'instructions, contrôle de style

Barre de la mesure, borne basse : 1 425,0. Fourchette 1 425,0 à 1 437,5, posée le 23 septembre 2026 sur 152 modèles, inchangée depuis.

Barrières

Aucune barrière : la présence dans la mesure vaut capacité.

Coût mensuel = entrée hors cache × prix d'entrée + entrée en cache × prix du cache + sortie × prix de sortie. L'écriture de cache est exclue en V1.

Sources de cette page

D'où viennent ces chiffres

Prix relevés une fois par jour, à 3h00 (heure de Paris). Licences, attributions et modifications

Ces chiffres viennent des sources publiques citées et reflètent le dernier import, pas l'état à la seconde. Les tarifs sont ceux publiés par les fournisseurs et peuvent changer sans préavis : vérifiez les chez eux avant de vous engager. Nos verdicts orientent un choix, ils ne le garantissent pas : à vous de tester le modèle sur vos propres cas et de valider votre calcul, y compris économique. Notre méthode

Le badge de ce verdict

Collez cet extrait sur votre site. Le badge se met à jour tout seul. Dès que le modèle ne tient plus le verdict, il n'affiche plus que la date de sa dernière vérification : nous ne laissons jamais un verdict périmé chez un tiers.

Le badge de ce verdict

Tous les modèles mesurés

Le classement entier sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style, du meilleur au moins bon, avec la barre à sa place. La note garantie est la borne basse de la fourchette publiée : c'est elle qui décide de l'élection.

La barre vaut 1 431,2, sa fourchette va de 1 425,0 à 1 437,5, et c'est sa borne basse, 1 425,0, qui coupe. Elle a été posée le 23 septembre 2026 sur 152 modèles, et n'a pas bougé depuis.

Rang Modèle Note Fourchette Coût mensuel Sort
1 Claude Fable 5
Anthropic
1 511,3 1 504,5 à 1 518,0 11,22 € Le meilleur
2 Claude Opus 4.6
Anthropic
1 499,8 1 494,7 à 1 504,9 5,61 € retenu
3 Claude Opus 5
Anthropic
1 493,2 1 485,2 à 1 501,1 5,61 € retenu
4 Claude Opus 4.7
Anthropic
1 492,6 1 487,0 à 1 498,1 5,61 € retenu
5 GPT-5.6 Sol
OpenAI
1 486,9 1 479,8 à 1 494,0 3,65 € retenu
6 Gemini 3.7 Flash première note
Google
1 484,4 1 470,8 à 1 498,1 1,37 € retenu
7 Kimi K3
Moonshot AI
1 483,7 1 476,0 à 1 491,5 2,36 € retenu
8 Claude Opus 4.5
Anthropic
1 483,0 1 476,3 à 1 489,8 9,11 € retenu
9 Gemini 3.1 Pro Preview préversion
Google
1 481,0 1 476,5 à 1 485,6 2,38 € retenu
10 GLM 5.3 première note
Z.ai
1 480,4 1 470,3 à 1 490,5 0,59 € retenu
11 Claude Opus 4.8
Anthropic
1 477,3 1 471,5 à 1 483,0 5,61 € retenu
12 Claude Sonnet 4.6
Anthropic
1 476,1 1 470,8 à 1 481,4 3,37 € retenu
13 GPT-5.5
OpenAI
1 473,2 1 467,9 à 1 478,6 5,96 € retenu
14 Gemini 3.6 Flash
Google
1 473,0 1 466,0 à 1 480,1 1,37 € retenu
15 GLM 5.3 Flash première note
Z.ai
1 470,8 1 460,5 à 1 481,2 0,0956 € Meilleur compromis
16 MiMo-V2.5-Pro
Xiaomi
1 470,3 1 464,8 à 1 475,8 0,26 € retenu
17 GLM 5.2
Z.ai
1 466,2 1 459,8 à 1 472,5 0,59 € retenu
18 Claude Sonnet 5
Anthropic
1 464,9 1 458,5 à 1 471,2 3,65 € retenu
19 Qwen3.7 Max
Qwen
1 464,4 1 447,3 à 1 481,4 1,55 € retenu
20 Claude Sonnet 4.5
Anthropic
1 464,0 1 459,4 à 1 468,6 5,47 € retenu
21 Gemini 3.5 Flash
Google
1 463,1 1 456,9 à 1 469,4 1,79 € retenu
22 GPT-5.6 Terra
OpenAI
1 462,1 1 455,2 à 1 469,0 4,07 € retenu
23 GPT-5.4
OpenAI
1 461,1 1 455,5 à 1 466,6 2,98 € retenu
24 GLM 5.1
Z.ai
1 460,5 1 455,0 à 1 466,0 0,97 € retenu
25 Claude Opus 4.1
Anthropic
1 459,0 1 453,3 à 1 464,8 16,83 € retenu
26 Gemini 3 Flash Preview préversion
Google
1 458,7 1 451,4 à 1 465,9 0,60 € retenu
27 GPT-5.2 Chat
OpenAI
1 457,2 1 450,8 à 1 463,6 2,33 € retenu
28 Kimi K2.6
Moonshot AI
1 453,7 1 447,3 à 1 460,2 0,65 € retenu
29 Grok 4.6 première note
xAI
1 452,6 1 444,1 à 1 461,1 3,01 € retenu
30 DeepSeek V4 Pro 0423
DeepSeek
1 452,6 1 446,8 à 1 458,3 0,86 € retenu
31 Qwen3.6 Max Preview préversion
Qwen
1 449,4 1 435,2 à 1 463,5 1,87 € retenu
32 Qwen3.7 Plus
Qwen
1 447,1 1 441,0 à 1 453,2 0,36 € retenu
33 GLM 5
Z.ai
1 446,3 1 439,6 à 1 453,1 0,64 € retenu
34 Hy3
Tencent
1 444,0 1 432,5 à 1 455,5 0,15 € retenu
35 GPT-5.6 Luna
OpenAI
1 442,2 1 435,3 à 1 449,1 0,41 € retenu
36 Gemini 3.5 Flash Lite
Google
1 441,7 1 434,6 à 1 448,9 0,41 € retenu
37 Kimi K2.5
Moonshot AI
1 439,2 1 434,2 à 1 444,2 0,67 € retenu
38 Gemini 2.5 Pro
Google
1 438,3 1 434,4 à 1 442,2 1,67 € retenu
39 Gemma 4 26B A4B
Google
1 438,0 1 424,1 à 1 452,0 0,0743 € Peut faire le job
40 Qwen3.6 Plus
Qwen
1 436,1 1 430,0 à 1 442,2 0,59 € retenu
41 Qwen3.5 397B A17B
Qwen
1 434,5 1 429,7 à 1 439,3 0,68 € retenu
42 GPT-5.4 Mini
OpenAI
1 434,3 1 428,7 à 1 439,8 1,52 € retenu
43 DeepSeek V4 Flash 0423
DeepSeek
1 428,1 1 422,1 à 1 434,0 0,0853 € retenu
44 GLM 4.7
Z.ai
1 426,9 1 416,5 à 1 437,3 0,58 € retenu
45 GPT-5.1
OpenAI
1 426,8 1 420,7 à 1 432,9 1,67 € retenu
46 Qwen3 Max
Qwen
1 425,6 1 418,2 à 1 432,9 0,93 € retenu
47 GPT-5.2
OpenAI
1 424,3 1 419,4 à 1 429,1 2,33 € retenu
48 Qwen3.8 27B première note
Qwen
1 424,0 1 414,0 à 1 434,1 0,26 € retenu
49 Mistral Medium 3.5
Mistral
1 421,4 1 411,1 à 1 431,8 2,63 € retenu
50 DeepSeek V3.2
DeepSeek
1 420,1 1 414,3 à 1 425,9 0,18 € retenu
La coupure : un modèle est au niveau quand sa borne haute atteint 1 425,0. Au dessus, les modèles au niveau ; en dessous, les autres.
51 Kimi K2 Thinking
Moonshot AI
1 418,0 1 413,0 à 1 423,1 0,70 € sous la barre
52 DeepSeek V3.1
DeepSeek
1 416,4 1 405,3 à 1 427,5 0,35 € retenu
53 Qwen3 235B A22B Instruct 2507
Qwen
1 415,4 1 411,3 à 1 419,6 0,0982 € sous la barre
54 Muse Glimmer 30B
Meta
1 415,4 1 398,7 à 1 432,1 0,32 € retenu
55 Claude Sonnet 4
Anthropic
1 415,1 1 408,1 à 1 422,0 3,37 € sous la barre
56 GPT-5
OpenAI
1 410,9 1 403,6 à 1 418,1 3,07 € sous la barre
57 Qwen3 VL 235B A22B Instruct
Qwen
1 410,0 1 398,7 à 1 421,3 0,28 € sous la barre
58 Qwen3.5-122B-A10B
Qwen
1 406,8 1 400,1 à 1 413,5 0,51 € sous la barre
59 Gemini 2.5 Flash
Google
1 400,3 1 396,5 à 1 404,2 0,41 € sous la barre
60 Qwen3.5-27B
Qwen
1 400,1 1 393,3 à 1 406,9 0,38 € sous la barre
61 Mistral Medium 3.1
Mistral
1 395,4 1 391,2 à 1 399,6 0,45 € sous la barre
62 Qwen3.5-35B-A3B
Qwen
1 387,8 1 381,2 à 1 394,5 0,20 € sous la barre
63 GPT-5.4 Nano
OpenAI
1 387,4 1 381,8 à 1 393,1 0,42 € sous la barre
64 Qwen3 235B A22B Thinking 2507
Qwen
1 385,2 1 372,7 à 1 397,7 0,48 € sous la barre
65 Qwen3 VL 235B A22B Thinking
Qwen
1 382,9 1 370,5 à 1 395,2 0,84 € sous la barre
66 Qwen3.5-Flash
Qwen
1 381,8 1 376,3 à 1 387,2 0,11 € sous la barre
67 MiniMax M2.5
MiniMax
1 380,2 1 374,2 à 1 386,3 0,28 € sous la barre
68 Qwen3 Next 80B A3B Instruct
Qwen
1 376,8 1 369,1 à 1 384,4 0,19 € sous la barre
69 GPT-5 Mini
OpenAI
1 372,3 1 364,7 à 1 379,9 0,61 € sous la barre
70 Gemini 2.5 Flash Lite
Google
1 369,0 1 361,9 à 1 376,0 0,11 € sous la barre
71 o3 Mini High
OpenAI
1 366,3 1 358,6 à 1 373,9 2,08 € sous la barre
72 Qwen3 30B A3B Instruct 2507
Qwen
1 366,0 1 358,1 à 1 373,9 0,081 € sous la barre
73 Mistral Medium 3
Mistral
1 365,9 1 358,7 à 1 373,1 0,45 € sous la barre
74 Qwen3 Next 80B A3B Thinking
Qwen
1 358,8 1 348,9 à 1 368,8 0,29 € sous la barre
75 Qwen3 235B A22B
Qwen
1 356,6 1 348,8 à 1 364,3 0,77 € sous la barre
76 GLM 4.7 Flash
Z.ai
1 348,7 1 338,3 à 1 359,1 0,0771 € sous la barre
77 o3 Mini
OpenAI
1 343,6 1 338,5 à 1 348,8 1,47 € sous la barre
78 Gemma 3 27B
Google
1 343,6 1 337,8 à 1 349,3 0,12 € sous la barre
79 MiniMax M2
MiniMax
1 337,4 1 324,3 à 1 350,4 0,32 € sous la barre
80 Qwen-Plus
Qwen
1 331,8 1 319,6 à 1 343,9 0,27 € sous la barre
81 Nova 2 Lite
Amazon
1 327,6 1 317,2 à 1 338,0 0,60 € sous la barre
82 GPT-5 Nano
OpenAI
1 327,1 1 314,0 à 1 340,2 0,12 € sous la barre
83 GPT-4o (2024-05-13)
OpenAI
1 325,5 1 320,4 à 1 330,5 8,06 € sous la barre
84 gpt-oss-120b
OpenAI
1 324,1 1 317,0 à 1 331,2 0,054 € sous la barre
85 GPT-4o (2024-08-06)
OpenAI
1 318,5 1 312,7 à 1 324,3 3,33 € sous la barre
86 Llama 4 Maverick
Meta
1 313,4 1 306,9 à 1 319,9 0,31 € sous la barre
87 Qwen3 30B A3B
Qwen
1 310,1 1 302,2 à 1 318,0 0,20 € sous la barre
88 Mistral Large 2407
Mistral
1 299,3 1 293,6 à 1 305,0 1,96 € sous la barre
89 Llama 4 Scout
Meta
1 298,9 1 291,6 à 1 306,2 0,16 € sous la barre
90 Mistral Large
Mistral
1 294,6 1 288,6 à 1 300,7 1,96 € sous la barre
91 Mistral Small 3.1 24B
Mistral
1 293,7 1 286,6 à 1 300,8 0,53 € sous la barre
92 GPT-4o-mini (2024-07-18)
OpenAI
1 293,1 1 288,3 à 1 298,0 0,20 € sous la barre
93 Llama 3.3 70B Instruct
Meta
1 292,6 1 287,6 à 1 297,7 0,16 € sous la barre
94 Nemotron 3 Nano 30B A3B
NVIDIA
1 290,5 1 281,2 à 1 299,9 0,0701 € sous la barre
95 GPT-4
OpenAI
1 284,8 1 277,5 à 1 292,1 46,27 € sous la barre
96 gpt-oss-20b
OpenAI
1 281,3 1 269,1 à 1 293,5 0,0315 € sous la barre
97 Nova Pro 1.0
Amazon
1 276,5 1 270,2 à 1 282,8 1,35 € sous la barre
98 Llama 3.1 70B Instruct
Meta
1 272,6 1 267,2 à 1 277,9 0,59 € sous la barre
99 Qwen2.5 Coder 32B Instruct
Qwen
1 264,0 1 252,1 à 1 276,0 1,00 € sous la barre
100 Nova Lite 1.0
Amazon
1 243,6 1 236,5 à 1 250,8 0,10 € sous la barre
101 GPT-3.5 Turbo
OpenAI
1 215,1 1 208,7 à 1 221,5 0,81 € sous la barre
102 Mixtral 8x22B Instruct
Mistral
1 215,1 1 208,5 à 1 221,6 1,96 € sous la barre
103 Nova Micro 1.0
Amazon
1 214,8 1 207,7 à 1 222,0 0,0589 € sous la barre
104 Llama 3.1 8B Instruct
Meta
1 190,9 1 185,3 à 1 196,5 0,0308 € sous la barre
105 Llama 3.2 3B Instruct
Meta
1 146,1 1 135,0 à 1 157,1 0,0932 € sous la barre
106 Llama 3.2 1B Instruct
Meta
1 085,7 1 074,3 à 1 097,2 0,0519 € sous la barre

Ce que devient le banc sur cette tâche

Les cinq populations forment une partition du banc : leur somme vaut le nombre de modèles au banc, sur chaque tâche, à chaque calcul.

0 modèle écarté par une barrière

aucun

52 modèles mesurés et éligibles
  • Claude Fable 5
  • Claude Opus 4.1
  • Claude Opus 4.5
  • Claude Opus 4.6
  • Claude Opus 4.7
  • Claude Opus 4.8
  • Claude Opus 5
  • Claude Sonnet 4.5
  • Claude Sonnet 4.6
  • Claude Sonnet 5
  • DeepSeek V3.1
  • DeepSeek V3.2
  • DeepSeek V4 Flash 0423
  • DeepSeek V4 Pro 0423
  • GLM 4.7
  • GLM 5
  • GLM 5.1
  • GLM 5.2
  • GLM 5.3
  • GLM 5.3 Flash
  • GPT-5.1
  • GPT-5.2
  • GPT-5.2 Chat
  • GPT-5.4
  • GPT-5.4 Mini
  • GPT-5.5
  • GPT-5.6 Luna
  • GPT-5.6 Sol
  • GPT-5.6 Terra
  • Gemini 2.5 Pro
  • Gemini 3 Flash Preview
  • Gemini 3.1 Pro Preview
  • Gemini 3.5 Flash
  • Gemini 3.5 Flash Lite
  • Gemini 3.6 Flash
  • Gemini 3.7 Flash
  • Gemma 4 26B A4B
  • Grok 4.6
  • Hy3
  • Kimi K2.5
  • Kimi K2.6
  • Kimi K3
  • MiMo-V2.5-Pro
  • Mistral Medium 3.5
  • Muse Glimmer 30B
  • Qwen3 Max
  • Qwen3.5 397B A17B
  • Qwen3.6 Max Preview
  • Qwen3.6 Plus
  • Qwen3.7 Max
  • Qwen3.7 Plus
  • Qwen3.8 27B
54 modèles mesurés sous le seuil
  • Claude Sonnet 4 : 1 415,1, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
  • GLM 4.7 Flash : 1 348,7, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
  • GPT-3.5 Turbo : 1 215,1, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
  • GPT-4 : 1 284,8, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
  • GPT-4o (2024-05-13) : 1 325,5, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
  • GPT-4o (2024-08-06) : 1 318,5, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
  • GPT-4o-mini (2024-07-18) : 1 293,1, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
  • GPT-5 : 1 410,9, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
  • GPT-5 Mini : 1 372,3, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
  • GPT-5 Nano : 1 327,1, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
  • GPT-5.4 Nano : 1 387,4, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
  • Gemini 2.5 Flash : 1 400,3, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
  • Gemini 2.5 Flash Lite : 1 369,0, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
  • Gemma 3 27B : 1 343,6, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
  • Kimi K2 Thinking : 1 418,0, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
  • Llama 3.1 70B Instruct : 1 272,6, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
  • Llama 3.1 8B Instruct : 1 190,9, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
  • Llama 3.2 1B Instruct : 1 085,7, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
  • Llama 3.2 3B Instruct : 1 146,1, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
  • Llama 3.3 70B Instruct : 1 292,6, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
  • Llama 4 Maverick : 1 313,4, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
  • Llama 4 Scout : 1 298,9, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
  • MiniMax M2 : 1 337,4, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
  • MiniMax M2.5 : 1 380,2, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
  • Mistral Large : 1 294,6, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
  • Mistral Large 2407 : 1 299,3, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
  • Mistral Medium 3 : 1 365,9, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
  • Mistral Medium 3.1 : 1 395,4, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
  • Mistral Small 3.1 24B : 1 293,7, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
  • Mixtral 8x22B Instruct : 1 215,1, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
  • Nemotron 3 Nano 30B A3B : 1 290,5, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
  • Nova 2 Lite : 1 327,6, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
  • Nova Lite 1.0 : 1 243,6, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
  • Nova Micro 1.0 : 1 214,8, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
  • Nova Pro 1.0 : 1 276,5, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
  • Qwen-Plus : 1 331,8, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
  • Qwen2.5 Coder 32B Instruct : 1 264,0, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
  • Qwen3 235B A22B : 1 356,6, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
  • Qwen3 235B A22B Instruct 2507 : 1 415,4, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
  • Qwen3 235B A22B Thinking 2507 : 1 385,2, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
  • Qwen3 30B A3B : 1 310,1, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
  • Qwen3 30B A3B Instruct 2507 : 1 366,0, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
  • Qwen3 Next 80B A3B Instruct : 1 376,8, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
  • Qwen3 Next 80B A3B Thinking : 1 358,8, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
  • Qwen3 VL 235B A22B Instruct : 1 410,0, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
  • Qwen3 VL 235B A22B Thinking : 1 382,9, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
  • Qwen3.5-122B-A10B : 1 406,8, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
  • Qwen3.5-27B : 1 400,1, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
  • Qwen3.5-35B-A3B : 1 387,8, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
  • Qwen3.5-Flash : 1 381,8, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
  • gpt-oss-120b : 1 324,1, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
  • gpt-oss-20b : 1 281,3, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
  • o3 Mini : 1 343,6, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
  • o3 Mini High : 1 366,3, sous la barre sur cette mesure, dont la borne basse est à 1 425,0
68 modèles non mesurés
  • Claude 3 Haiku : 0,28 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • Claude Haiku 4.5 : 1,12 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • Codestral 2508 : 0,29 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • DeepSeek V4 Flash 0731 : 0,0493 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • Devstral 2 2512 : 0,45 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • GPT-3.5 Turbo (older v0613) : 1,54 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • GPT-3.5 Turbo 16k : 4,49 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • GPT-3.5 Turbo Instruct : 2,24 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • GPT-4 Turbo : 16,12 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • GPT-4.1 : 2,31 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • GPT-4.1 Mini : 0,46 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • GPT-4.1 Nano : 0,12 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • GPT-4o : 3,33 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • GPT-4o (2024-11-20) : 3,33 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • GPT-4o-mini : 0,20 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • GPT-5 Pro : 29,45 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • GPT-5.1-Codex : 1,67 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • GPT-5.1-Codex-Max : 1,67 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • GPT-5.1-Codex-Mini : 0,34 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • GPT-5.2 Pro : 41,22 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • GPT-5.2-Codex : 2,33 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • GPT-5.3-Codex : 2,33 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • GPT-5.4 Pro : 54,68 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • GPT-5.5 Pro : 54,68 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • GPT-5.6 Luna Pro : 0,24 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • GPT-5.6 Sol Pro : 2,24 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • GPT-5.6 Terra Pro : 2,38 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • Gemini 2.5 Pro Preview 06-05 : 1,67 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • Gemini 3.1 Flash Lite : 0,30 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • Granite 4.0 Micro : 0,0317 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • Hermes 4 405B : 1,61 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • Kimi K2.7 Code : 0,81 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • Llama 3.3 Euryale 70B : 0,96 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • Ministral 3 14B 2512 : 0,17 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • Ministral 3 3B 2512 : 0,0841 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • Ministral 3 8B 2512 : 0,13 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • Mistral Small 4 : 0,16 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • Nova Premier 1.0 : 3,07 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • Palmyra X5 : 2,10 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • Qwen Plus 0728 : 0,42 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • Qwen3 14B : 0,19 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • Qwen3 30B A3B Thinking 2507 : 0,45 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • Qwen3 8B : 0,20 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • Qwen3 Coder 30B A3B Instruct : 0,12 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • Qwen3 Coder 480B A35B : 0,35 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • Qwen3 Coder Flash : 0,23 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • Qwen3 Coder Next : 0,19 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • Qwen3 Coder Plus : 0,77 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • Qwen3 Max Thinking : 1,37 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • Qwen3 VL 30B A3B Instruct : 0,22 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • Qwen3 VL 30B A3B Thinking : 0,45 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • Qwen3 VL 32B Instruct : 0,17 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • Qwen3 VL 8B Instruct : 0,20 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • Qwen3 VL 8B Thinking : 0,40 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • Qwen3.5 Plus 2026-02-15 : 0,47 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • Qwen3.5 Plus 2026-04-20 : 0,55 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • Qwen3.6 27B : 0,37 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • Qwen3.6 Flash : 0,34 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • Qwen3.7 Flash : 0,0344 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • ReMM SLERP 13B : 0,54 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • Saba : 0,20 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • Voxtral Small 24B 2507 : 0,0982 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • o1 : 19,98 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • o1-pro : 252,39 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • o3 : 2,31 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • o3 Pro : 33,65 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • o4 Mini : 1,27 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • o4 Mini High : 1,27 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style

4 modèles moins chers que Peut faire le job ne sont pas mesurés sur ce que cette tâche exige.

20 modèles récents, pas encore mesurés
  • Claude Fable 5.1 : 10,69 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • Claude Opus 5.5 : 4,35 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • DeepSeek V4 Flash Vision Exp : 0,20 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • DeepSeek V4 Pro 0813 : 0,37 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • DeepSeek V4.1 Flash : 0,13 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • GPT-6 Astra : 11,22 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • GPT-6 Astra Pro : 11,22 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • GPT-6 Luna : 0,11 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • GPT-6 Luna Pro : 0,11 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • GPT-6 Sol : 2,24 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • GPT-6 Sol Pro : 2,24 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • Gemini 3.8 Flash : 0,84 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • Hy-MT2-1.8B : 0,0741 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • Hy-MT2-30B-A3B : 0,12 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • Hy-MT2-7B : 0,12 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • Hy4 preview : 0,79 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • Qwen3.8 2.4T A95B : 2,00 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • Qwen3.8 Flash : 0,15 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • Qwen3.8 Max (0902) : 2,00 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style
  • Qwen3.8 Omni Flash : 0,15 € par mois, non mesuré sur préférence humaine, LMArena Text, suivi d'instructions, contrôle de style