Quel modèle d'IA choisir en 2026 : la grille de décision, prix à l'appui
5 min de lectureL'équipe Tukai
- IA
- guide
- modèles
- facturation
La question « quel est le meilleur modèle » n'a pas de réponse, et ce n'est pas une esquive : elle n'a pas de réponse parce qu'elle ne précise pas la tâche ni le budget. En revanche « quel modèle pour cette tâche-là, à ce prix-là » en a une, et elle change assez peu d'un mois à l'autre.
Cet article donne la grille, avec les tarifs fournisseurs que nous payons réellement. Chiffres relevés le 1er août 2026 dans notre table de tarification — ils bougent, et un article daté ne remplace pas l'affichage dans l'application.
Chat : trois niveaux, pas cinquante
Le catalogue compte plusieurs centaines de modèles de conversation. En pratique, le choix se ramène à trois niveaux, et l'écart de prix entre eux est ce qui doit guider la décision.
| Modèle | Entrée (USD / M jetons) | Sortie (USD / M jetons) | Cache lu |
|---|---|---|---|
| Claude Haiku 4.5 | 1,00 | 5,00 | 0,10 |
| GPT-5 | 1,25 | 10,00 | 0,125 |
| Claude Sonnet 5 | 2,00 | 10,00 | 0,20 |
| Gemini 3 Pro | 2,00 | 12,00 | 0,20 |
| Grok 4 | 3,00 | 15,00 | 0,60 |
| Claude Opus 5 | 5,00 | 25,00 | 0,50 |
| DeepSeek V4 Pro | 0,435 | 0,87 | 0,003625 |
Trois observations qui valent plus que le classement.
La sortie coûte deux à cinq fois l'entrée. C'est vrai chez tous les fournisseurs. La conséquence pratique : un prompt long avec une réponse courte coûte beaucoup moins qu'un prompt court avec une réponse fleuve. Demander « réponds en trois lignes » n'est pas une coquetterie de style, c'est un levier de coût.
Le cache change l'ordre de grandeur. Relire un contexte déjà envoyé coûte environ dix fois moins que l'envoyer pour la première fois. Sur une conversation longue, où le même historique repart à chaque tour, l'écart entre un système qui met en cache et un système qui ne le fait pas est de l'ordre de un à dix.
L'écart haut-bas est d'un facteur trente. Entre DeepSeek V4 Pro en sortie (0,87 $) et Claude Opus 5 (25 $), il y a presque trente fois. Utiliser un modèle de raisonnement pour reformuler un courriel n'est pas une erreur de goût, c'est trente fois trop cher.
La règle qui en découle : dégrossir avec un modèle économique, terminer avec un modèle capable. C'est exactement ce que permet un changement de modèle en cours de conversation, et c'est ce qu'un abonnement mono-fournisseur interdit.
Image : le prix dépend de la qualité, pas du modèle
C'est la capacité où l'écart interne à un même modèle dépasse l'écart entre modèles.
| Rendu | Prix (USD) |
|---|---|
| GPT Image 1 — qualité basse | 0,0109 |
| GPT Image 1 — qualité moyenne | 0,0422 |
| FLUX.1 Pro | 0,04 |
| GPT Image 1 — qualité haute | 0,1664 |
Entre la qualité basse et la qualité haute du même modèle, il y a un facteur quinze. C'est plus que l'écart entre deux générateurs concurrents. Un service qui annonce un prix unique par image a donc nécessairement arbitré à votre place.
Le choix pratique : qualité basse pour explorer une direction, qualité haute uniquement pour ce qui sera publié. Générer dix vignettes en qualité haute pour n'en garder qu'une coûte quinze fois le nécessaire.
Vidéo : l'ordre de grandeur change complètement
| Modèle | Prix (USD / seconde) |
|---|---|
| Kling 2.5 | 0,07 |
| Sora 2 | 0,10 |
| Veo 3 | 0,40 |
Une seconde de Veo 3 coûte à peu près autant que deux images en qualité haute, ou que seize mille jetons de sortie sur Claude Sonnet 5. Un plan de huit secondes en Veo 3, c'est 3,20 $ — davantage qu'un mois entier d'usage conversationnel modéré.
Ce n'est pas un argument contre la vidéo, c'est un argument pour la connaître avant de générer. C'est aussi la raison pour laquelle un service à forfait ne peut pas laisser la vidéo ouverte à tous : quelques utilisateurs intensifs y consomment l'abonnement de plusieurs centaines d'autres.
Ce que ces chiffres ne disent pas
Trois limites, pour que la grille reste utilisable.
Ce sont des tarifs fournisseurs, pas votre prix. Tukai convertit en EDNT au taux de change figé au moment de l'appel, et applique sa marge. Les montants que vous payez sont sur la page tarifs ; le mécanisme est décrit dans comment nous calculons le prix d'une génération.
Les prix bougent. Cette table est datée du 1er août 2026. Un article ne peut pas rester à jour ; l'application, si.
Le prix ne dit pas la qualité. Un modèle deux fois plus cher n'est pas deux fois meilleur, et sur la plupart des tâches courantes l'écart de résultat entre un modèle intermédiaire et un modèle haut de gamme est bien plus faible que l'écart de prix. Le seul test qui vaut est le vôtre, sur vos propres cas.
La grille, en une phrase par usage
- Écrire, reformuler, corriger : un modèle intermédiaire suffit largement.
- Raisonner sur un problème difficile, écrire du code non trivial : un modèle haut de gamme se justifie, sur ces tâches-là seulement.
- Traiter du volume — classer, extraire, résumer en série : le modèle le plus économique, et on mesure la qualité avant de monter en gamme.
- Images : qualité basse pour chercher, qualité haute pour publier.
- Vidéo : savoir ce que coûte la seconde avant de lancer.
- Documents privés : ce n'est pas une question de modèle mais d'indexation — voir le RAG.
Chaque capacité a sa page, avec les modèles réellement disponibles et le plan qui la débloque : chat, images, vidéo, audio, 3D, retouche, documents.
Un chiffre faux ou périmé dans cet article ? Signalez-le : la correction sera faite dans le texte et datée en clair, à côté de la date de publication. C’est une règle écrite — voir la charte éditoriale.