Résumer.
Résumer un texte court à moyen, article ou compte rendu.
Les recommandations WoBench reposent sur des évaluations humaines.
Service de résumé intégré. 4 000 tokens en entrée et 400 en sortie par exécution
Filtre actif : Poids ouverts. 271 modèles du banc retirés du calcul, les trois verdicts sont recalculés sur le reste. Retirer le filtre Selon nos vérifications du 6 septembre 2026, saisies à la main fournisseur par fournisseur. Ce n'est pas une garantie.
Verdicts rendus parmi les 35 modèles mesurés sur ce que cette tâche exige, sur 321 au banc. Les 286 autres
0 modèles au niveau sur 35 mesurés, 321 au banc.
montants convertis au taux de la Banque centrale européenne du 23 septembre 2026
Le spectre des prix compare tous les modèles au niveau de chaque tâche. Il ne tient pas compte du filtre d'hébergement, il est donc masqué tant que ce filtre est actif.
Arrivés au niveau
Aucun modèle au niveau n'a reçu sa première note depuis moins de 45 jours.
Comment ce verdict est calculé
Le seuil de cette tâche
préférence humaine, LMArena Text, contrôle de style
Barrières
Aucune barrière : la présence dans la mesure vaut capacité.
Coût mensuel = entrée hors cache × prix d'entrée + entrée en cache × prix du cache + sortie × prix de sortie. L'écriture de cache est exclue en V1.
Sources de cette page
D'où viennent ces chiffres
- Taux de référence de la Banque centrale européenne (ecb.europa.eu) Réutilisation libre avec citation de la source https://www.ecb.europa.eu/stats/eurofxref/eurofxref-daily.xml
- Epoch AI (epoch.ai) CC-BY https://epoch.ai/benchmarks/use-this-data
- LiteLLM (github.com/BerriAI/litellm) MIT https://github.com/BerriAI/litellm
- LMArena (lmarena.ai) CC-BY-4.0 https://huggingface.co/datasets/lmarena-ai/leaderboard-dataset
- models.dev MIT https://models.dev
- Prix et fournisseurs : OpenRouter (openrouter.ai) CGU OpenRouter https://openrouter.ai/docs
- Prix et caractéristiques : OpenRouter (openrouter.ai) CGU OpenRouter https://openrouter.ai/api/v1/models
- Agent conversationnel : tau²-bench, Sierra Research (github.com/sierra-research) MIT https://github.com/sierra-research/tau2-bench
- Fidélité au document : classement d'hallucination de Vectara (github.com/vectara) Apache-2.0 https://github.com/vectara/hallucination-leaderboard
Prix relevés une fois par jour, à 3h00 (heure de Paris). Licences, attributions et modifications
Ces chiffres viennent des sources publiques citées et reflètent le dernier import, pas l'état à la seconde. Les tarifs sont ceux publiés par les fournisseurs et peuvent changer sans préavis : vérifiez les chez eux avant de vous engager. Nos verdicts orientent un choix, ils ne le garantissent pas : à vous de tester le modèle sur vos propres cas et de valider votre calcul, y compris économique. Notre méthode
Tous les modèles mesurés
Le classement entier sur préférence humaine, LMArena Text, contrôle de style, du meilleur au moins bon, avec la barre à sa place. La note garantie est la borne basse de la fourchette publiée : c'est elle qui décide de l'élection.
| Rang | Modèle | Note | Fourchette | Coût mensuel | Sort |
|---|---|---|---|---|---|
| La coupure : un modèle est au niveau quand sa borne haute atteint . Au dessus, les modèles au niveau ; en dessous, les autres. | |||||
| 1 |
Kimi K3
Moonshot AI
|
1 484,8 | 1 479,5 à 1 490,0 | 1 104 € | sous la barre |
| 2 |
MiMo-V2.5-Pro
Xiaomi
|
1 467,4 | 1 463,6 à 1 471,3 | 128,09 € | sous la barre |
| 3 |
Kimi K2.6
Moonshot AI
|
1 460,4 | 1 455,9 à 1 465,0 | 283,94 € | sous la barre |
| 4 |
DeepSeek V4 Pro 0423
DeepSeek
|
1 457,3 | 1 453,3 à 1 461,3 | 401,83 € | sous la barre |
| 5 |
Hy3
Tencent
|
1 455,8 | 1 448,6 à 1 463,0 | 64,78 € | sous la barre |
| 6 |
Gemma 4 31B
Google
|
1 451,1 | 1 443,5 à 1 458,7 | 43,47 € | sous la barre |
| 7 |
Kimi K2.5
Moonshot AI
|
1 450,4 | 1 447,0 à 1 453,7 | 299,71 € | sous la barre |
| 8 |
MiniMax M3
MiniMax
|
1 441,3 | 1 437,0 à 1 445,5 | 117,78 € | sous la barre |
| 9 |
Inkling
Thinking Machines
|
1 440,1 | 1 435,2 à 1 445,1 | 474,98 € | sous la barre |
| 10 |
Gemma 4 26B A4B
Google
|
1 437,9 | 1 430,3 à 1 445,5 | 22,43 € | sous la barre |
| 11 |
DeepSeek V4 Flash 0423
DeepSeek
|
1 435,6 | 1 431,4 à 1 439,7 | 36,57 € | sous la barre |
| 12 |
MiMo-V2.5
Xiaomi
|
1 433,6 | 1 429,3 à 1 438,0 | 50,06 € | sous la barre |
| 13 |
Kimi K2 Thinking
Moonshot AI
|
1 430,1 | 1 427,0 à 1 433,3 | 297,96 € | sous la barre |
| 14 |
Muse Glimmer 30B
Meta
|
1 427,2 | 1 417,2 à 1 437,1 | 143,72 € | sous la barre |
| 15 |
Nemotron 3 Ultra
NVIDIA
|
1 425,6 | 1 418,6 à 1 432,6 | 328,63 € | sous la barre |
| 16 |
DeepSeek V3.2
DeepSeek
|
1 425,3 | 1 418,7 à 1 431,9 | 84,05 € | sous la barre |
| 17 |
MiniMax M2.7
MiniMax
|
1 415,2 | 1 411,6 à 1 418,8 | 103,06 € | sous la barre |
| 18 |
Hy3 preview
préversion
Tencent
|
1 412,7 | 1 405,2 à 1 420,2 | 84,13 € | sous la barre |
| 19 |
Inkling Small
Thinking Machines
|
1 404,6 | 1 399,1 à 1 410,1 | 199,81 € | sous la barre |
| 20 |
R1
DeepSeek
|
1 398,0 | 1 393,1 à 1 402,9 | 333,01 € | sous la barre |
| 21 |
Step 3.5 Flash
StepFun
|
1 394,1 | 1 390,5 à 1 397,8 | 45,57 € | sous la barre |
| 22 |
MiniMax M2.5
MiniMax
|
1 390,3 | 1 386,3 à 1 394,3 | 127,95 € | sous la barre |
| 23 |
MiniMax M2.1
MiniMax
|
1 383,8 | 1 378,5 à 1 389,1 | 147,23 € | sous la barre |
| 24 |
Trinity Large Thinking
Arcee AI
|
1 369,0 | 1 364,3 à 1 373,6 | 115,68 € | sous la barre |
| 25 |
Gemma 3 27B
Google
|
1 365,2 | 1 361,5 à 1 368,9 | 33,65 € | sous la barre |
| 26 |
Nemotron 3 Super
NVIDIA
|
1 360,5 | 1 353,3 à 1 367,8 | 43,82 € | sous la barre |
| 27 |
DeepSeek V3
DeepSeek
|
1 358,4 | 1 353,6 à 1 363,1 | 126,29 € | sous la barre |
| 28 |
gpt-oss-120b
OpenAI
|
1 352,3 | 1 347,9 à 1 356,7 | 16,48 € | sous la barre |
| 29 |
MiniMax M2
MiniMax
|
1 345,9 | 1 338,1 à 1 353,6 | 125,14 € | sous la barre |
| 30 |
Gemma 3 12B
Google
|
1 341,7 | 1 332,2 à 1 351,2 | 22,79 € | sous la barre |
| 31 |
gpt-oss-20b
OpenAI
|
1 317,2 | 1 310,8 à 1 323,6 | 9,46 € | sous la barre |
| 32 |
Nemotron 3 Nano 30B A3B
NVIDIA
|
1 314,2 | 1 308,7 à 1 319,8 | 24,54 € | sous la barre |
| 33 |
Gemma 3 4B
Google
|
1 303,1 | 1 293,8 à 1 312,5 | 21,03 € | sous la barre |
| 34 |
Command R+ (08-2024)
Cohere
|
1 276,1 | 1 269,5 à 1 282,7 | 1 227 € | sous la barre |
| 35 |
Command R (08-2024)
Cohere
|
1 250,1 | 1 243,5 à 1 256,8 | 73,61 € | sous la barre |
Ce que devient le banc sur cette tâche
Les cinq populations forment une partition du banc : leur somme vaut le nombre de modèles au banc, sur chaque tâche, à chaque calcul.
0 modèle écarté par une barrière
aucun
0 modèle mesuré et éligible
aucun
35 modèles mesurés sous le seuil
- Command R (08-2024) : 1 250,1, sous la barre sur cette mesure, dont la borne basse est à
- Command R+ (08-2024) : 1 276,1, sous la barre sur cette mesure, dont la borne basse est à
- DeepSeek V3 : 1 358,4, sous la barre sur cette mesure, dont la borne basse est à
- DeepSeek V3.2 : 1 425,3, sous la barre sur cette mesure, dont la borne basse est à
- DeepSeek V4 Flash 0423 : 1 435,6, sous la barre sur cette mesure, dont la borne basse est à
- DeepSeek V4 Pro 0423 : 1 457,3, sous la barre sur cette mesure, dont la borne basse est à
- Gemma 3 12B : 1 341,7, sous la barre sur cette mesure, dont la borne basse est à
- Gemma 3 27B : 1 365,2, sous la barre sur cette mesure, dont la borne basse est à
- Gemma 3 4B : 1 303,1, sous la barre sur cette mesure, dont la borne basse est à
- Gemma 4 26B A4B : 1 437,9, sous la barre sur cette mesure, dont la borne basse est à
- Gemma 4 31B : 1 451,1, sous la barre sur cette mesure, dont la borne basse est à
- Hy3 : 1 455,8, sous la barre sur cette mesure, dont la borne basse est à
- Hy3 preview : 1 412,7, sous la barre sur cette mesure, dont la borne basse est à
- Inkling : 1 440,1, sous la barre sur cette mesure, dont la borne basse est à
- Inkling Small : 1 404,6, sous la barre sur cette mesure, dont la borne basse est à
- Kimi K2 Thinking : 1 430,1, sous la barre sur cette mesure, dont la borne basse est à
- Kimi K2.5 : 1 450,4, sous la barre sur cette mesure, dont la borne basse est à
- Kimi K2.6 : 1 460,4, sous la barre sur cette mesure, dont la borne basse est à
- Kimi K3 : 1 484,8, sous la barre sur cette mesure, dont la borne basse est à
- MiMo-V2.5 : 1 433,6, sous la barre sur cette mesure, dont la borne basse est à
- MiMo-V2.5-Pro : 1 467,4, sous la barre sur cette mesure, dont la borne basse est à
- MiniMax M2 : 1 345,9, sous la barre sur cette mesure, dont la borne basse est à
- MiniMax M2.1 : 1 383,8, sous la barre sur cette mesure, dont la borne basse est à
- MiniMax M2.5 : 1 390,3, sous la barre sur cette mesure, dont la borne basse est à
- MiniMax M2.7 : 1 415,2, sous la barre sur cette mesure, dont la borne basse est à
- MiniMax M3 : 1 441,3, sous la barre sur cette mesure, dont la borne basse est à
- Muse Glimmer 30B : 1 427,2, sous la barre sur cette mesure, dont la borne basse est à
- Nemotron 3 Nano 30B A3B : 1 314,2, sous la barre sur cette mesure, dont la borne basse est à
- Nemotron 3 Super : 1 360,5, sous la barre sur cette mesure, dont la borne basse est à
- Nemotron 3 Ultra : 1 425,6, sous la barre sur cette mesure, dont la borne basse est à
- R1 : 1 398,0, sous la barre sur cette mesure, dont la borne basse est à
- Step 3.5 Flash : 1 394,1, sous la barre sur cette mesure, dont la borne basse est à
- Trinity Large Thinking : 1 369,0, sous la barre sur cette mesure, dont la borne basse est à
- gpt-oss-120b : 1 352,3, sous la barre sur cette mesure, dont la borne basse est à
- gpt-oss-20b : 1 317,2, sous la barre sur cette mesure, dont la borne basse est à
7 modèles non mesurés
- Command R7B (12-2024) : 18,40 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
- DeepSeek V4 Flash 0731 : 24,06 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
- Kimi K2.7 Code : 354,92 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
- Laguna XS 2.1 : 25,24 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
- Nemotron 3.5 Content Safety : 77,12 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
- Step 3.7 Flash : 88,34 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
- gpt-oss-safeguard-20b : 36,81 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
8 modèles récents, pas encore mesurés
- DeepSeek V4 Flash Vision Exp : 98,25 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
- DeepSeek V4 Pro 0813 : 182,26 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
- DeepSeek V4.1 Flash : 62,57 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
- Hy4 preview : 380,02 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
- MiMo-V2.6-Flash : 58,89 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
- MiMo-V2.6-Pro : 182,98 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
- MiMo-V2.6-Pro-UltraSpeed : 1 830 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style
- Nemotron 3.5 Lightning : 31,55 € par mois, non mesuré sur préférence humaine, LMArena Text, contrôle de style