GPT-5.6 et Grok 4.5 lancés le même jour, la guerre des coûts s'intensifie
Un « Super Thursday » de lancements frontière, des API dont les prix s'écartent d'un facteur 100, et une inférence qui dévore désormais plus de la moitié des dépenses d'infrastructure. Tour d'horizon chiffré.

Le 9 juillet 2026 restera comme une journée rare : OpenAI lance publiquement sa série GPT-5.6 le jour même où xAI sort Grok 4.5. Derrière ces annonces simultanées, une réalité plus structurante pour toute organisation qui consomme de l’IA : l’écart de prix entre modèles frontière s’étire désormais d’un facteur 100, et savoir arbitrer devient une compétence financière à part entière.
Un « Super Thursday » de lancements frontière
OpenAI avait confirmé la veille que sa série GPT-5.6, trois modèles nommés Sol, Terra et Luna, arriverait ce jeudi sur ChatGPT, l’API et Codex, après plusieurs semaines de preview réservée à des partenaires. Les prix rapportés au lancement : Sol à 5 $/30 $ par million de tokens (input/output), Terra à 2,50 $/15 $ et Luna à 1 $/6 $. Détail piquant relevé par les premiers benchmarks : Luna, le modèle le moins cher de la série, dépasserait Terra sur certains bancs d’essai agentiques.
Le même jour, xAI a ouvert l’accès à Grok 4.5, présenté comme un modèle de classe frontière, réservé pour l’instant aux abonnés SuperGrok Heavy et Premium+, sans prix API publié ni benchmarks indépendants au moment où nous écrivons. Deux lancements majeurs en une journée : le signe d’un marché où le rythme de sortie est devenu une arme concurrentielle en soi.
La guerre des prix, relancée par l’Asie
La pression sur les prix ne vient pas des géants américains. En mai, DeepSeek a baissé ses tarifs d’environ 75 % : son V4 Pro coûte désormais 0,435 $/0,87 $ par million de tokens, et V4 Flash descend à 0,14 $/0,28 $ avec un contexte d’un million de tokens. Selon des chiffres cités par CNBC début juillet, 30 à 46 % des tokens consommés par les entreprises américaines passeraient déjà par des modèles chinois, facturés 60 à 90 % moins cher que leurs équivalents occidentaux.
À l’autre extrémité du spectre, Anthropic a fait de son modèle le plus capable un produit premium assumé : depuis le 8 juillet, Claude Fable 5 est facturé 10 $/50 $ par million de tokens, accessible aux abonnés via un système de crédits. Entre le modèle le plus cher et le plus économique du marché, l’écart de prix atteint un facteur 100 pour l’input, du jamais vu.
Le prix d’un token n’est plus une donnée technique enfouie dans une facture cloud. C’est devenu un paramètre stratégique, au même titre que le choix d’un fournisseur d’énergie.
Tableau comparatif : les prix API au 9 juillet 2026
| Modèle | Input ($/M tokens) | Output ($/M tokens) | Note |
|---|---|---|---|
| Claude Fable 5 (Anthropic) | 10.00 | 50.00 | add-on crédits depuis le 08.07 |
| GPT-5.6 Sol (OpenAI) | 5.00 | 30.00 | lancé le 09.07 |
| Claude Opus 4.8 | 5.00 | 25.00 | |
| GPT-5.6 Terra | 2.50 | 15.00 | lancé le 09.07 |
| Gemini 3.1 Pro (Google) | 2.00 | 12.00 | double au-delà de 200k de contexte |
| Claude Sonnet 5 | 2.00 | 10.00 | tarif de lancement jusqu’au 31.08, puis 3/15 |
| Gemini 3.5 Flash | 1.50 | 9.00 | |
| Grok 4.3 (xAI) | 1.25 | 2.50 | contexte 1M |
| GPT-5.6 Luna | 1.00 | 6.00 | lancé le 09.07 |
| DeepSeek V4 Pro | 0.435 | 0.87 | après la baisse de −75 % (mai) |
| Grok 4.1 Fast | 0.20 | 0.50 | |
| DeepSeek V4 Flash | 0.14 | 0.28 | contexte 1M |
Prix relevés le 9 juillet 2026 auprès d’agrégateurs spécialisés et de pages officielles. Les tarifs GPT-5.6 datent du jour du lancement et Grok 4.5 n’a pas encore de prix API publié, à confirmer sur les pages officielles des éditeurs.
Côté abonnements : la fin annoncée de l’illimité
Le grand public n’échappe pas au mouvement. ChatGPT s’étage désormais de la formule Go à 8 $ jusqu’à Pro à 200 $ par mois, avec un palier intermédiaire à 100 $ lancé en avril pour répondre au Claude Max d’Anthropic. Chez Anthropic justement, Pro reste à 20 $ et Max culmine à 200 $, mais l’accès au modèle frontière Fable 5 passe désormais par des crédits facturés au prix API, y compris pour les abonnés. Un dirigeant d’OpenAI a d’ailleurs publiquement comparé les forfaits illimités à de « l’électricité illimitée » : intenables à terme, avec un abonnement Plus qui pourrait atteindre 44 $ d’ici 2029.
Le message est cohérent d’un éditeur à l’autre : l’usage intensif de l’IA se paiera à la consommation, et les organisations ont intérêt à mesurer précisément la leur.
Pourquoi les prix baissent en façade et montent en coulisses
Paradoxe apparent : les prix par token baissent, mais les dépenses explosent. L’inférence, faire tourner les modèles, pas les entraîner, représente désormais 55 % des dépenses d’infrastructure IA, contre un tiers en 2023. Les loyers des GPU H100 ont regagné environ 40 % en cinq mois, portés par cette demande. Et les hyperscalers prévoient de 400 à 750 milliards de dollars de capex datacenters pour 2026 selon les périmètres, Anthropic vient par exemple de signer un bail de 19 milliards de dollars avec TeraWulf.
Côté financement, le premier semestre 2026 a battu tous les records : 510 milliards de dollars investis en venture capital, dont 43 % captés par OpenAI et Anthropic à eux seuls. Selon Fortune, Anthropic aurait même dépassé OpenAI en revenus annualisés (~47 milliards de dollars auto-déclarés, chiffres non audités). La valeur se concentre, les coûts se déplacent vers l’usage, et la facture finale atterrit chez les entreprises utilisatrices.
Ce que cela signifie pour une organisation suisse
Trois conséquences pratiques. D’abord, le multi-modèle n’est plus une option : router chaque tâche vers le modèle au bon rapport capacité/prix peut diviser la facture par dix sans perte de qualité perceptible. Ensuite, la traçabilité des coûts devient un enjeu de gouvernance : sans mesure fine de qui consomme quoi, impossible d’arbitrer. Enfin, la dépendance à un fournisseur unique est devenue un risque tarifaire : les changements de prix se décident désormais en jours, pas en années.
Maîtrisez vos coûts d'IA au lieu de les subir. Comoto OS orchestre les meilleurs modèles du marché depuis un noyau souverain hébergé en Suisse : chaque tâche routée vers le bon modèle, chaque token tracé, chaque décision auditable.
Découvrir Comoto OSLisez nos prochains papers en avant-première.
Certains articles sont réservés. Laissez votre e-mail pour débloquer l'accès aux prochaines publications de Meotis Research.




