Tâches / Synthétiser

Synthétiser.

Résumer ou analyser 50K à 1M tokens.

Les recommandations WoBench reposent sur des évaluations humaines.

contexte d'au moins 200 000 tokens
Mis à jour le 23 septembre 2026 à 16h45
321 modèles évalués
méthode, version 1

Quelques rapports par mois. 100 000 tokens en entrée et 2 000 en sortie par exécution

Filtre actif : Hébergement en UE. 127 modèles du banc retirés du calcul, les trois verdicts sont recalculés sur le reste. Retirer le filtre Selon nos vérifications du 6 septembre 2026, saisies à la main fournisseur par fournisseur. Ce n'est pas une garantie.

Verdicts rendus parmi les 77 modèles mesurés sur ce que cette tâche exige, sur 321 au banc. Les 244 autres

48 modèles au niveau sur 77 mesurés, 321 au banc.

montants convertis au taux de la Banque centrale européenne du 23 septembre 2026

Peut faire le job
le choix économique qui couvre le besoin
Google
Mesure principale
préférence humaine, LMArena Text, contrôle de style
1 430,3 à 1 445,5 · barre 1 437,0 43e sur 77 mesurés sur cette tâche
88e sur 402 chez préférence humaine, LMArena Text, contrôle de style
fourchette publiée par la source · 5 804 votes
égalité jugée sur les intervalles publiés par la source
Peu de votes : sa fourchette est nettement plus large que celle des autres modèles mesurés.

Barre 1 437,0, la borne basse de sa fourchette : c'est elle qui coupe. Le segment est la fourchette de ce modèle : il est au niveau dès que sa borne haute atteint celle de la barre. Le meilleur de la tâche est à 1 500,9, sa note garantie.

Barre de la mesure, borne basse : 1 437,0. Fourchette 1 437,0 à 1 445,5, posée le 23 septembre 2026 sur 152 modèles, inchangée depuis.

Seconde mesure, compréhension d'un long texte, Fiction.liveBench relayé par Epoch AI : non mesuré, elle n'ordonne rien ici.
au niveau de la barre sur préférence humaine, LMArena Text, contrôle de style
0,0813 €
par mois,
à 20 exécutions
chez Darkbloom
Pourquoi lui

Le moins cher des modèles au niveau de la barre.

Meilleur compromis
le meilleur équilibre entre performance et coût
Z.ai
Mesure principale
préférence humaine, LMArena Text, contrôle de style
1 468,8 à 1 482,0 · barre 1 437,0 12e sur 77 mesurés sur cette tâche
29e sur 402 chez préférence humaine, LMArena Text, contrôle de style
fourchette publiée par la source · 10 038 votes
égalité jugée sur les intervalles publiés par la source

Barre 1 437,0, la borne basse de sa fourchette : c'est elle qui coupe. Le segment est la fourchette de ce modèle : il est au niveau dès que sa borne haute atteint celle de la barre. Le meilleur de la tâche est à 1 500,9, sa note garantie.

Barre de la mesure, borne basse : 1 437,0. Fourchette 1 437,0 à 1 445,5, posée le 23 septembre 2026 sur 152 modèles, inchangée depuis.

Seconde mesure, compréhension d'un long texte, Fiction.liveBench relayé par Epoch AI : non mesuré, elle n'ordonne rien ici.
au niveau de la barre sur préférence humaine, LMArena Text, contrôle de style
0,17 €
par mois,
à 20 exécutions
chez Morph
Pourquoi lui

99 % moins cher que Le meilleur, 30,3 points de mesure en moins.

Le meilleur
le modèle le plus performant, indépendamment du prix
Anthropic
Mesure principale
préférence humaine, LMArena Text, contrôle de style
1 500,9 à 1 510,4 · barre 1 437,0 1er sur 77 mesurés sur cette tâche
1er sur 402 chez préférence humaine, LMArena Text, contrôle de style
fourchette publiée par la source · 30 057 votes
égalité jugée sur les intervalles publiés par la source

Barre 1 437,0, la borne basse de sa fourchette : c'est elle qui coupe. Le segment est la fourchette de ce modèle : il est au niveau dès que sa borne haute atteint celle de la barre. Le meilleur de la tâche est à 1 500,9, sa note garantie.

Barre de la mesure, borne basse : 1 437,0. Fourchette 1 437,0 à 1 445,5, posée le 23 septembre 2026 sur 152 modèles, inchangée depuis.

Seconde mesure, compréhension d'un long texte, Fiction.liveBench relayé par Epoch AI : non mesuré, elle n'ordonne rien ici.
au niveau de la barre sur préférence humaine, LMArena Text, contrôle de style
19,28 €
par mois,
à 20 exécutions
chez Claude Platform on AWS
Pourquoi lui

1er sur les 77 modèles que cette tâche juge. 237 fois le prix de Peut faire le job, pour 67,8 points de mesure en plus.

Le spectre des prix compare tous les modèles au niveau de chaque tâche. Il ne tient pas compte du filtre d'hébergement, il est donc masqué tant que ce filtre est actif.

Arrivés au niveau

Au niveau, et notés pour la première fois depuis moins de 45 jours. Ils sont jugés comme les autres dès leur première note : leur note repose simplement sur moins de votes.

Voir ce qui a changé

Cette tâche exige une note d'au moins 1 441,3 sur préférence humaine, LMArena Text, contrôle de style. Cette barre appartient à la mesure, elle ne bouge pas, et toutes les tâches qui lisent cette mesure exigent la même : c'est la note du modèle qui la franchit, donc le doute lui profite.

Comment ce verdict est calculé

Le seuil de cette tâche

préférence humaine, LMArena Text, contrôle de style

Barre de la mesure, borne basse : 1 437,0. Fourchette 1 437,0 à 1 445,5, posée le 23 septembre 2026 sur 152 modèles, inchangée depuis.

Seconde mesure : compréhension d'un long texte, Fiction.liveBench relayé par Epoch AI

Barrières

  • contexte d'au moins 200 000 tokens

Coût mensuel = entrée hors cache × prix d'entrée + entrée en cache × prix du cache + sortie × prix de sortie. L'écriture de cache est exclue en V1.

Sources de cette page

D'où viennent ces chiffres

Prix relevés une fois par jour, à 3h00 (heure de Paris). Licences, attributions et modifications

Ces chiffres viennent des sources publiques citées et reflètent le dernier import, pas l'état à la seconde. Les tarifs sont ceux publiés par les fournisseurs et peuvent changer sans préavis : vérifiez les chez eux avant de vous engager. Nos verdicts orientent un choix, ils ne le garantissent pas : à vous de tester le modèle sur vos propres cas et de valider votre calcul, y compris économique. Notre méthode

Le badge de ce verdict

Collez cet extrait sur votre site. Le badge se met à jour tout seul. Dès que le modèle ne tient plus le verdict, il n'affiche plus que la date de sa dernière vérification : nous ne laissons jamais un verdict périmé chez un tiers.

Le badge de ce verdict

Tous les modèles mesurés

Le classement entier sur préférence humaine, LMArena Text, contrôle de style, du meilleur au moins bon, avec la barre à sa place. La note garantie est la borne basse de la fourchette publiée : c'est elle qui décide de l'élection.

La barre vaut 1 441,3, sa fourchette va de 1 437,0 à 1 445,5, et c'est sa borne basse, 1 437,0, qui coupe. Elle a été posée le 23 septembre 2026 sur 152 modèles, et n'a pas bougé depuis.

Rang Modèle Note Fourchette Coût mensuel Sort
1 Claude Fable 5
Anthropic
1 505,7 1 500,9 à 1 510,4 19,28 € Le meilleur
2 Claude Opus 4.6
Anthropic
1 497,3 1 493,9 à 1 500,8 9,64 € retenu
3 Claude Opus 4.7
Anthropic
1 494,4 1 490,6 à 1 498,3 9,64 € retenu
4 Gemini 3.7 Flash première note
Google
1 489,8 1 481,6 à 1 498,0 1,71 € retenu
5 Claude Opus 5
Anthropic
1 487,4 1 481,9 à 1 492,9 9,64 € retenu
6 Gemini 3.1 Pro Preview préversion
Google
1 486,8 1 483,6 à 1 490,0 3,93 € retenu
7 Kimi K3
Moonshot AI
1 484,8 1 479,5 à 1 490,0 4,00 € retenu
8 GPT-5.6 Sol
OpenAI
1 483,5 1 478,6 à 1 488,4 4,56 € retenu
9 GLM 5.3 première note
Z.ai
1 483,0 1 476,6 à 1 489,5 1,05 € retenu
10 Gemini 3.6 Flash
Google
1 479,9 1 475,0 à 1 484,7 1,71 € retenu
11 GPT-5.5
OpenAI
1 476,1 1 472,3 à 1 479,9 9,82 € retenu
12 GLM 5.3 Flash première note
Z.ai
1 475,4 1 468,8 à 1 482,0 0,17 € Meilleur compromis
13 Gemini 3.5 Flash
Google
1 473,9 1 469,4 à 1 478,4 2,94 € retenu
14 Gemini 3 Flash Preview préversion
Google
1 473,7 1 469,3 à 1 478,1 0,98 € retenu
15 Qwen3.7 Max
Qwen
1 473,2 1 463,2 à 1 483,2 2,74 € retenu
16 Claude Opus 4.8
Anthropic
1 473,2 1 469,1 à 1 477,4 9,64 € retenu
17 Claude Opus 4.5
Anthropic
1 472,8 1 468,9 à 1 476,7 11,39 € retenu
18 Claude Sonnet 4.6
Anthropic
1 472,6 1 469,0 à 1 476,2 5,78 € retenu
19 GLM 5.2
Z.ai
1 472,1 1 467,5 à 1 476,7 1,05 € retenu
20 MiMo-V2.5-Pro
Xiaomi
1 467,4 1 463,6 à 1 471,3 0,56 € retenu
21 GPT-5.6 Terra
OpenAI
1 466,0 1 461,2 à 1 470,9 4,77 € retenu
22 GPT-5.4
OpenAI
1 465,7 1 461,9 à 1 469,5 4,91 € retenu
23 GLM 5.1
Z.ai
1 465,5 1 461,6 à 1 469,4 1,80 € retenu
24 Claude Sonnet 5
Anthropic
1 461,2 1 456,6 à 1 465,8 4,56 € retenu
25 Kimi K2.6
Moonshot AI
1 460,4 1 455,9 à 1 465,0 1,08 € retenu
26 Qwen3.6 Max Preview préversion
Qwen
1 460,0 1 451,6 à 1 468,4 2,02 € retenu
27 GLM 5
Z.ai
1 457,6 1 453,3 à 1 462,0 1,12 € retenu
28 DeepSeek V4 Pro 0423
DeepSeek
1 457,3 1 453,3 à 1 461,3 1,74 € retenu
29 Claude Sonnet 4.5
Anthropic
1 456,2 1 453,4 à 1 459,0 6,84 € retenu
30 Gemini 3.5 Flash Lite
Google
1 455,9 1 450,9 à 1 460,8 0,61 € retenu
31 Hy3
Tencent
1 455,8 1 448,6 à 1 463,0 0,25 € retenu
32 Qwen3.7 Plus
Qwen
1 455,6 1 451,1 à 1 460,0 0,61 € retenu
33 Grok 4.6 première note
xAI
1 455,6 1 449,7 à 1 461,4 4,14 € retenu
34 GPT-5.6 Luna
OpenAI
1 452,5 1 447,6 à 1 457,3 0,48 € retenu
35 Kimi K2.5
Moonshot AI
1 450,4 1 447,0 à 1 453,7 1,05 € retenu
36 Claude Opus 4.1
Anthropic
1 449,9 1 446,4 à 1 453,3 28,92 € retenu
37 GPT-5.4 Mini
OpenAI
1 448,1 1 444,3 à 1 452,0 1,79 € retenu
38 Gemini 2.5 Pro
Google
1 445,5 1 443,0 à 1 448,0 2,54 € retenu
39 Qwen3.6 Plus
Qwen
1 443,3 1 439,0 à 1 447,5 0,64 € retenu
40 Qwen3.5 397B A17B
Qwen
1 441,8 1 438,5 à 1 445,1 0,77 € retenu
41 GLM 4.7
Z.ai
1 441,7 1 435,6 à 1 447,9 0,98 € retenu
42 GPT-5.1
OpenAI
1 439,0 1 435,4 à 1 442,7 2,54 € retenu
43 Gemma 4 26B A4B
Google
1 437,9 1 430,3 à 1 445,5 0,0813 € Peut faire le job
44 Qwen3.8 27B première note
Qwen
1 437,1 1 430,6 à 1 443,6 0,26 € retenu
45 GPT-5.2
OpenAI
1 435,8 1 432,6 à 1 439,1 3,56 € retenu
46 DeepSeek V4 Flash 0423
DeepSeek
1 435,6 1 431,4 à 1 439,7 0,16 € retenu
47 Qwen3 Max
Qwen
1 434,7 1 430,2 à 1 439,2 1,50 € retenu
48 GPT-5
OpenAI
1 434,7 1 430,1 à 1 439,2 3,24 € retenu
La coupure : un modèle est au niveau quand sa borne haute atteint 1 437,0. Au dessus, les modèles au niveau ; en dessous, les autres.
49 Kimi K2 Thinking
Moonshot AI
1 430,1 1 427,0 à 1 433,3 1,14 € sous la barre
50 Mistral Medium 3.5
Mistral
1 426,3 1 419,8 à 1 432,9 2,89 € sous la barre
51 Qwen3 235B A22B Instruct 2507
Qwen
1 423,0 1 420,4 à 1 425,6 0,17 € sous la barre
52 Qwen3.5-122B-A10B
Qwen
1 416,8 1 412,4 à 1 421,2 0,53 € sous la barre
53 Qwen3 VL 235B A22B Instruct
Qwen
1 414,1 1 407,5 à 1 420,6 0,38 € sous la barre
54 Gemini 2.5 Flash
Google
1 409,7 1 407,2 à 1 412,2 0,61 € sous la barre
55 Qwen3.5-27B
Qwen
1 407,9 1 403,5 à 1 412,3 0,40 € sous la barre
56 GPT-5.4 Nano
OpenAI
1 402,1 1 398,2 à 1 406,0 0,48 € sous la barre
57 Claude Sonnet 4
Anthropic
1 400,9 1 396,5 à 1 405,4 5,78 € sous la barre
58 Qwen3 Next 80B A3B Instruct
Qwen
1 399,3 1 394,5 à 1 404,1 0,20 € sous la barre
59 Qwen3.5-Flash
Qwen
1 396,7 1 393,0 à 1 400,5 0,12 € sous la barre
60 Qwen3.5-35B-A3B
Qwen
1 395,0 1 390,6 à 1 399,3 0,28 € sous la barre
61 MiniMax M2.5
MiniMax
1 390,3 1 386,3 à 1 394,3 0,51 € sous la barre
62 GPT-5 Mini
OpenAI
1 389,6 1 384,9 à 1 394,2 0,65 € sous la barre
63 Qwen3 30B A3B Instruct 2507
Qwen
1 382,3 1 377,4 à 1 387,3 0,0912 € sous la barre
64 Gemini 2.5 Flash Lite
Google
1 374,6 1 370,1 à 1 379,2 0,19 € sous la barre
65 Qwen3 Next 80B A3B Thinking
Qwen
1 369,0 1 363,1 à 1 374,8 0,30 € sous la barre
66 GLM 4.7 Flash
Z.ai
1 366,3 1 360,4 à 1 372,1 0,12 € sous la barre
67 o3 Mini High
OpenAI
1 363,5 1 358,2 à 1 368,7 2,39 € sous la barre
68 o3 Mini
OpenAI
1 347,7 1 344,2 à 1 351,3 2,08 € sous la barre
69 Qwen-Plus
Qwen
1 345,9 1 337,6 à 1 354,2 0,48 € sous la barre
70 MiniMax M2
MiniMax
1 345,9 1 338,1 à 1 353,6 0,48 € sous la barre
71 GPT-5 Nano
OpenAI
1 337,5 1 330,5 à 1 344,4 0,13 € sous la barre
72 Nova 2 Lite
Amazon
1 335,9 1 329,8 à 1 342,1 0,61 € sous la barre
73 Llama 4 Maverick
Meta
1 326,9 1 322,6 à 1 331,2 0,35 € sous la barre
74 Llama 4 Scout
Meta
1 321,5 1 316,7 à 1 326,2 0,19 € sous la barre
75 Nemotron 3 Nano 30B A3B
NVIDIA
1 314,2 1 308,7 à 1 319,8 0,0946 € sous la barre
76 Nova Pro 1.0
Amazon
1 290,0 1 285,4 à 1 294,6 1,51 € sous la barre
77 Nova Lite 1.0
Amazon
1 260,3 1 255,1 à 1 265,5 0,11 € sous la barre

Ce que devient le banc sur cette tâche

Les cinq populations forment une partition du banc : leur somme vaut le nombre de modèles au banc, sur chaque tâche, à chaque calcul.

  • contexte d'au moins 200 000 tokens : 51 modèle(s) écarté(s)
51 modèles écartés par une barrière
  • DeepSeek V3.1 : contexte d'au moins 200 000 tokens
  • DeepSeek V3.2 : contexte d'au moins 200 000 tokens
  • GPT-3.5 Turbo : contexte d'au moins 200 000 tokens
  • GPT-3.5 Turbo (older v0613) : contexte d'au moins 200 000 tokens
  • GPT-3.5 Turbo 16k : contexte d'au moins 200 000 tokens
  • GPT-3.5 Turbo Instruct : contexte d'au moins 200 000 tokens
  • GPT-4 : contexte d'au moins 200 000 tokens
  • GPT-4 Turbo : contexte d'au moins 200 000 tokens
  • GPT-4o : contexte d'au moins 200 000 tokens
  • GPT-4o (2024-05-13) : contexte d'au moins 200 000 tokens
  • GPT-4o (2024-08-06) : contexte d'au moins 200 000 tokens
  • GPT-4o (2024-11-20) : contexte d'au moins 200 000 tokens
  • GPT-4o-mini : contexte d'au moins 200 000 tokens
  • GPT-4o-mini (2024-07-18) : contexte d'au moins 200 000 tokens
  • GPT-5.2 Chat : contexte d'au moins 200 000 tokens
  • Gemma 3 27B : contexte d'au moins 200 000 tokens
  • Granite 4.0 Micro : contexte d'au moins 200 000 tokens
  • Hermes 4 405B : contexte d'au moins 200 000 tokens
  • Hy-MT2-1.8B : contexte d'au moins 200 000 tokens
  • Hy-MT2-30B-A3B : contexte d'au moins 200 000 tokens
  • Hy-MT2-7B : contexte d'au moins 200 000 tokens
  • Llama 3.1 70B Instruct : contexte d'au moins 200 000 tokens
  • Llama 3.1 8B Instruct : contexte d'au moins 200 000 tokens
  • Llama 3.2 1B Instruct : contexte d'au moins 200 000 tokens
  • Llama 3.2 3B Instruct : contexte d'au moins 200 000 tokens
  • Llama 3.3 70B Instruct : contexte d'au moins 200 000 tokens
  • Llama 3.3 Euryale 70B : contexte d'au moins 200 000 tokens
  • Ministral 3 3B 2512 : contexte d'au moins 200 000 tokens
  • Mistral Large : contexte d'au moins 200 000 tokens
  • Mistral Large 2407 : contexte d'au moins 200 000 tokens
  • Mistral Medium 3 : contexte d'au moins 200 000 tokens
  • Mistral Medium 3.1 : contexte d'au moins 200 000 tokens
  • Mistral Small 3.1 24B : contexte d'au moins 200 000 tokens
  • Mixtral 8x22B Instruct : contexte d'au moins 200 000 tokens
  • Muse Glimmer 30B : contexte d'au moins 200 000 tokens
  • Nova Micro 1.0 : contexte d'au moins 200 000 tokens
  • Qwen2.5 Coder 32B Instruct : contexte d'au moins 200 000 tokens
  • Qwen3 14B : contexte d'au moins 200 000 tokens
  • Qwen3 235B A22B : contexte d'au moins 200 000 tokens
  • Qwen3 235B A22B Thinking 2507 : contexte d'au moins 200 000 tokens
  • Qwen3 30B A3B : contexte d'au moins 200 000 tokens
  • Qwen3 30B A3B Thinking 2507 : contexte d'au moins 200 000 tokens
  • Qwen3 8B : contexte d'au moins 200 000 tokens
  • Qwen3 VL 235B A22B Thinking : contexte d'au moins 200 000 tokens
  • Qwen3 VL 32B Instruct : contexte d'au moins 200 000 tokens
  • Qwen3 VL 8B Thinking : contexte d'au moins 200 000 tokens
  • ReMM SLERP 13B : contexte d'au moins 200 000 tokens
  • Saba : contexte d'au moins 200 000 tokens
  • Voxtral Small 24B 2507 : contexte d'au moins 200 000 tokens
  • gpt-oss-120b : contexte d'au moins 200 000 tokens
  • gpt-oss-20b : contexte d'au moins 200 000 tokens
48 modèles mesurés et éligibles
  • Claude Fable 5
  • Claude Opus 4.1
  • Claude Opus 4.5
  • Claude Opus 4.6
  • Claude Opus 4.7
  • Claude Opus 4.8
  • Claude Opus 5
  • Claude Sonnet 4.5
  • Claude Sonnet 4.6
  • Claude Sonnet 5
  • DeepSeek V4 Flash 0423
  • DeepSeek V4 Pro 0423
  • GLM 4.7
  • GLM 5
  • GLM 5.1
  • GLM 5.2
  • GLM 5.3
  • GLM 5.3 Flash
  • GPT-5
  • GPT-5.1
  • GPT-5.2
  • GPT-5.4
  • GPT-5.4 Mini
  • GPT-5.5
  • GPT-5.6 Luna
  • GPT-5.6 Sol
  • GPT-5.6 Terra
  • Gemini 2.5 Pro
  • Gemini 3 Flash Preview
  • Gemini 3.1 Pro Preview
  • Gemini 3.5 Flash
  • Gemini 3.5 Flash Lite
  • Gemini 3.6 Flash
  • Gemini 3.7 Flash
  • Gemma 4 26B A4B
  • Grok 4.6
  • Hy3
  • Kimi K2.5
  • Kimi K2.6
  • Kimi K3
  • MiMo-V2.5-Pro
  • Qwen3 Max
  • Qwen3.5 397B A17B
  • Qwen3.6 Max Preview
  • Qwen3.6 Plus
  • Qwen3.7 Max
  • Qwen3.7 Plus
  • Qwen3.8 27B
29 modèles mesurés sous le seuil
  • Claude Sonnet 4 : 1 400,9, sous la barre sur cette mesure, dont la borne basse est à 1 437,0
  • GLM 4.7 Flash : 1 366,3, sous la barre sur cette mesure, dont la borne basse est à 1 437,0
  • GPT-5 Mini : 1 389,6, sous la barre sur cette mesure, dont la borne basse est à 1 437,0
  • GPT-5 Nano : 1 337,5, sous la barre sur cette mesure, dont la borne basse est à 1 437,0
  • GPT-5.4 Nano : 1 402,1, sous la barre sur cette mesure, dont la borne basse est à 1 437,0
  • Gemini 2.5 Flash : 1 409,7, sous la barre sur cette mesure, dont la borne basse est à 1 437,0
  • Gemini 2.5 Flash Lite : 1 374,6, sous la barre sur cette mesure, dont la borne basse est à 1 437,0
  • Kimi K2 Thinking : 1 430,1, sous la barre sur cette mesure, dont la borne basse est à 1 437,0
  • Llama 4 Maverick : 1 326,9, sous la barre sur cette mesure, dont la borne basse est à 1 437,0
  • Llama 4 Scout : 1 321,5, sous la barre sur cette mesure, dont la borne basse est à 1 437,0
  • MiniMax M2 : 1 345,9, sous la barre sur cette mesure, dont la borne basse est à 1 437,0
  • MiniMax M2.5 : 1 390,3, sous la barre sur cette mesure, dont la borne basse est à 1 437,0
  • Mistral Medium 3.5 : 1 426,3, sous la barre sur cette mesure, dont la borne basse est à 1 437,0
  • Nemotron 3 Nano 30B A3B : 1 314,2, sous la barre sur cette mesure, dont la borne basse est à 1 437,0
  • Nova 2 Lite : 1 335,9, sous la barre sur cette mesure, dont la borne basse est à 1 437,0
  • Nova Lite 1.0 : 1 260,3, sous la barre sur cette mesure, dont la borne basse est à 1 437,0
  • Nova Pro 1.0 : 1 290,0, sous la barre sur cette mesure, dont la borne basse est à 1 437,0
  • Qwen-Plus : 1 345,9, sous la barre sur cette mesure, dont la borne basse est à 1 437,0
  • Qwen3 235B A22B Instruct 2507 : 1 423,0, sous la barre sur cette mesure, dont la borne basse est à 1 437,0
  • Qwen3 30B A3B Instruct 2507 : 1 382,3, sous la barre sur cette mesure, dont la borne basse est à 1 437,0
  • Qwen3 Next 80B A3B Instruct : 1 399,3, sous la barre sur cette mesure, dont la borne basse est à 1 437,0
  • Qwen3 Next 80B A3B Thinking : 1 369,0, sous la barre sur cette mesure, dont la borne basse est à 1 437,0
  • Qwen3 VL 235B A22B Instruct : 1 414,1, sous la barre sur cette mesure, dont la borne basse est à 1 437,0
  • Qwen3.5-122B-A10B : 1 416,8, sous la barre sur cette mesure, dont la borne basse est à 1 437,0
  • Qwen3.5-27B : 1 407,9, sous la barre sur cette mesure, dont la borne basse est à 1 437,0
  • Qwen3.5-35B-A3B : 1 395,0, sous la barre sur cette mesure, dont la borne basse est à 1 437,0
  • Qwen3.5-Flash : 1 396,7, sous la barre sur cette mesure, dont la borne basse est à 1 437,0
  • o3 Mini : 1 347,7, sous la barre sur cette mesure, dont la borne basse est à 1 437,0
  • o3 Mini High : 1 363,5, sous la barre sur cette mesure, dont la borne basse est à 1 437,0
49 modèles non mesurés
  • Claude 3 Haiku : 0,48 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • Claude Haiku 4.5 : 1,93 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • Codestral 2508 : 0,56 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • DeepSeek V4 Flash 0731 : 0,0981 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • Devstral 2 2512 : 0,77 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • GPT-4.1 : 3,79 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • GPT-4.1 Mini : 0,76 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • GPT-4.1 Nano : 0,19 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • GPT-5 Pro : 30,50 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • GPT-5.1-Codex : 2,54 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • GPT-5.1-Codex-Max : 2,54 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • GPT-5.1-Codex-Mini : 0,51 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • GPT-5.2 Pro : 42,70 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • GPT-5.2-Codex : 3,56 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • GPT-5.3-Codex : 3,56 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • GPT-5.4 Pro : 58,89 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • GPT-5.5 Pro : 58,89 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • GPT-5.6 Luna Pro : 0,39 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • GPT-5.6 Sol Pro : 3,86 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • GPT-5.6 Terra Pro : 3,93 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • Gemini 2.5 Pro Preview 06-05 : 2,54 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • Gemini 3.1 Flash Lite : 0,49 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • Kimi K2.7 Code : 1,35 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • Ministral 3 14B 2512 : 0,36 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • Ministral 3 8B 2512 : 0,27 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • Mistral Small 4 : 0,28 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • Nova Premier 1.0 : 4,82 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • Palmyra X5 : 1,68 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • Qwen Plus 0728 : 0,48 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • Qwen3 Coder 30B A3B Instruct : 0,13 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • Qwen3 Coder 480B A35B : 0,45 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • Qwen3 Coder Flash : 0,38 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • Qwen3 Coder Next : 0,24 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • Qwen3 Coder Plus : 1,25 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • Qwen3 Max Thinking : 1,50 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • Qwen3 VL 30B A3B Instruct : 0,25 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • Qwen3 VL 30B A3B Thinking : 0,43 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • Qwen3 VL 8B Instruct : 0,22 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • Qwen3.5 Plus 2026-02-15 : 0,51 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • Qwen3.5 Plus 2026-04-20 : 0,59 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • Qwen3.6 27B : 0,60 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • Qwen3.6 Flash : 0,37 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • Qwen3.7 Flash : 0,0571 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • o1 : 28,39 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • o1-pro : 283,94 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • o3 : 3,79 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • o3 Pro : 37,86 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • o4 Mini : 2,08 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • o4 Mini High : 2,08 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style

1 modèles moins chers que Peut faire le job ne sont pas mesurés sur ce que cette tâche exige.

17 modèles récents, pas encore mesurés
  • Claude Fable 5.1 : 19,28 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • Claude Opus 5.5 : 7,71 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • DeepSeek V4 Flash Vision Exp : 0,40 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • DeepSeek V4 Pro 0813 : 0,74 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • DeepSeek V4.1 Flash : 0,21 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • GPT-6 Astra : 19,28 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • GPT-6 Astra Pro : 19,28 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • GPT-6 Luna : 0,19 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • GPT-6 Luna Pro : 0,19 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • GPT-6 Sol : 3,86 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • GPT-6 Sol Pro : 3,86 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • Gemini 3.8 Flash : 1,45 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • Hy4 preview : 1,55 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • Qwen3.8 2.4T A95B : 3,72 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • Qwen3.8 Flash : 0,28 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • Qwen3.8 Max (0902) : 3,72 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
  • Qwen3.8 Omni Flash : 0,28 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style