237

L'écart de prix entre celui qui fait le job et le meilleur.

Mis à jour le 23 septembre 2026.

montants convertis au taux de la Banque centrale européenne du 23 septembre 2026

Quel LLM pour quelle tâche à quel prix ?

The right AI for the job.

Pour chaque tâche, trois modèles : celui qui peut faire le job, le meilleur compromis, et le meilleur sans regarder le prix. Avec ce que chacun coûte par mois, à estimer suivant vos besoins.

Les notations WoBench reposent sur des évaluations humaines.

321 modèles 10 tâches 9 sources publiques aucun sponsor dans les verdicts
Le meilleur
Verdict de la semaine 1 sur 10
Claude Fable 5 Anthropic
au niveau 1 500,9 à 1 510,4 · 1er sur 102 meilleur

Préféré 6 fois sur 10 à celui qui fait le job

192,80 € par mois, au volume Moyen

237 fois le prix de celui qui fait le job, qui coûte 0,81 € par mois.

20,3 L'écart de prix entre celui qui fait le job et le meilleur.

Sur Agent, boucles longues avec appels d'outils et reprises sur erreur. Le, le moins cher qui fait le job coûte 3,66 € par mois, le meilleur 74,14 €. 19 modèles mesurés, 7 au niveau.

Peut faire le job
le choix économique qui couvre le besoin
Z.ai
3e sur 19
3,66 € par mois,
à 1 000 exécutions
Le moins cher des modèles au niveau de la barre.
Pas de compromis

Pas de compromis ici : entre 3,66 € et 74,14 €, aucun modèle n'approche assez la note du meilleur.

Il faut au moins 0,0099 en note garantie, entre 3,66 € et 74,14 €.

3 modèles au niveau tombent dans cette fenêtre de prix.

Le meilleur coûte 20 fois l'entrée.

Le meilleur
le modèle le plus performant, indépendamment du prix
xAI
1er sur 19
74,14 € par mois,
à 1 000 exécutions
1er sur les 19 modèles que cette tâche juge. 20 fois le prix de Peut faire le job, pour 0,0 points de mesure en plus.

Volume Moyen. Le détail des mesures et la liste complète des modèles sont sur la page de la tâche. Les notations WoBench reposent sur des évaluations humaines.

Voyez ce qu'ils coûtent, du moins cher au plus cher.

Un point par modèle et par tâche. le moins cher qui fait le job le meilleur compromis le meilleur Comparé au prix d'entrée, échelle adaptée aux grands écarts

7 modèles placés sur Agent, au volume Moyen.

Explorer le classement complet, tâche par tâche

Le marché en un écran, 10 tâches, 29 verdicts.

Une ligne par tâche, les trois verdicts, au volume Moyen. Chaque ligne ouvre sa tâche.

Tâche Peut faire le job Meilleur compromis Le meilleur Écart
Trier et extraire Trier, étiqueter et extraire des données structurées à grand volume.
Gemma 4 26B A4B Google 1,86 €
GLM 5.3 Flash Z.ai 2,39 €
Claude Fable 5 Anthropic 280,43 €
×151
Chercher sur le web Rechercher et synthétiser de l'information sur le web.
Gemini 3 Flash Preview préversion Google 9,46 €
Claude Sonnet 4.6 Anthropic 52,58 €
GPT-5.6 Sol OpenAI 63,10 €
×6,7
Résumer Résumer un texte court à moyen, article ou compte rendu.
Gemma 4 26B A4B Google 1,12 €
GLM 5.3 Flash Z.ai 2,08 €
Claude Fable 5 Anthropic 262,90 €
×234
Synthétiser Résumer ou analyser 50K à 1M tokens.
Gemma 4 26B A4B Google 0,81 €
GLM 5.3 Flash Z.ai 1,65 €
Claude Fable 5 Anthropic 192,80 €
×237
RAG Répondre à partir des documents que vous fournissez.
GPT-5.6 Luna OpenAI 34,28 €
Claude Sonnet 4.6 Anthropic 309,18 €
Claude Opus 5 Anthropic 778,20 €
×22,7
Rédiger Écrire des textes, des emails et des contenus éditoriaux.
Gemma 4 26B A4B Google 0,57 €
MiMo-V2.5-Pro Xiaomi 2,08 €
Claude Fable 5 Anthropic 131,45 €
×229
Coder Écrire, corriger ou expliquer du code.
Gemma 4 26B A4B Google 3,94 €
GLM 5.3 Flash Z.ai 5,21 €
Claude Fable 5 Anthropic 683,55 €
×173
Web Dev Un site ou une application web complète à partir d'une consigne, jugée sur le résultat.
GLM 5.3 Flash Z.ai 1,13 €
Kimi K3 Moonshot AI 38,65 €
Claude Opus 5 Anthropic 92,02 €
×81,4
Agent Boucles longues avec appels d'outils et reprises sur erreur.
GLM 5.3 Flash Z.ai 3,66 €
pas de compromis : le meilleur coûte moins de cinq fois l'entrée de gamme
Grok 4.5 xAI 74,14 €
×20,3
Analyser des images Décrire, expliquer ou répondre sur une photo, une capture ou un graphique.
Gemma 4 26B A4B Google 1,03 €
GLM 5.3 Flash Z.ai 1,83 €
Claude Fable 5 Anthropic 241,00 €
×233
×237
Le chiffre de la semaine

L'écart de coût entre le meilleur et le moins cher qui fait le job, sur Synthétiser.

Le moins cher qui fait le job, Gemma 4 26B A4B, coûte 0,0813 € par mois. Le meilleur, Claude Fable 5, coûte 19,28 €. À 20 exécutions par mois, pour une tâche que les deux savent faire.

Prix : OpenRouter, relevés le 23 septembre 2026, convertis au taux de la Banque centrale européenne.

Notes : LMArena, classement général ; Epoch AI, Fiction.liveBench.

Ouvrir Synthétiser
Votre WoBench

Le bon choix d'hier, l'est-il encore aujourd'hui ?

Suivez les modèles que vous utilisez : sur la tâche qui vous occupe, chacun dit où il se situe, et ce qu'il coûte comparé à celui qui fait le job. Le reste du temps, on se tait.

Gratuit. Vous partez quand vous voulez, on efface tout.

D'où viennent ces chiffres Banque centrale européenne, Réutilisation libre avec citation de la source Epoch AI, CC-BY LiteLLM, MIT LMArena, CC-BY-4.0 models.dev, MIT OpenRouter (fournisseurs et prix par fournisseur), CGU OpenRouter OpenRouter (modèles), CGU OpenRouter tau²-bench (Sierra Research), MIT Vectara (classement d'hallucination), Apache-2.0 Toutes les sources, licences et dates Prix relevés une fois par jour, à 3h00 (heure de Paris).

Ces chiffres viennent des sources publiques citées et reflètent le dernier import, pas l'état à la seconde. Les tarifs sont ceux publiés par les fournisseurs et peuvent changer sans préavis : vérifiez les chez eux avant de vous engager. Nos verdicts orientent un choix, ils ne le garantissent pas : à vous de tester le modèle sur vos propres cas et de valider votre calcul, y compris économique. Notre méthode