Kimi K3 fait chuter les prix, Anthropic joue la carte de la Bourse
Le modèle chinois Kimi K3 s'invite dans le top 4 mondial à 3 $ / 15 $ le million de tokens, xAI publie enfin le tarif de Grok 4.5, et Anthropic répond à la pression par un dossier d'IPO plutôt que par une baisse de prix.

Dix jours après le « Super Thursday » du 9 juillet, qui avait vu OpenAI et xAI lancer GPT-5.6 et Grok 4.5 le même jour, le tableau se précise et se complique. Un modèle chinois s’invite dans le top 4 mondial à un prix cassé, xAI publie enfin le tarif de son modèle phare, et Anthropic choisit de répondre à la pression concurrentielle non pas en baissant ses prix, mais en déposant discrètement son dossier d’entrée en bourse. Deux courses parallèles se dessinent : celle des prix, qui ne cesse de descendre, et celle des valorisations, qui ne cesse de monter.
Kimi K3 : la Chine s’invite dans le top 4 mondial
Moonshot AI a mis en ligne Kimi K3 le 16 juillet, un modèle open-weight de 2,8 mille milliards de paramètres (MoE, seuls 16 des 896 experts sont activés par token), avec un contexte d’un million de tokens et un mode de raisonnement permanent. Sur les bancs d’essai indépendants publiés dans la foulée, il se classe 4ᵉ modèle frontière au monde, derrière Claude Fable 5 et GPT-5.6 Sol, mais devant Claude Opus 4.8, tout en étant facturé 3 $ / 15 $ par million de tokens (input/output), avec un tarif cache-hit à 0,30 $. C’est le premier modèle open-weight à entrer aussi haut dans le classement, et il est disponible aussi bien via l’API Moonshot que via des agrégateurs comme OpenRouter, ce qui ouvre la voie à un hébergement souverain pour les organisations qui préfèrent ne pas dépendre d’un point d’accès unique.
Grok 4.5 a enfin un prix, mais pas encore pour l’Europe
Le 9 juillet, xAI avait lancé Grok 4.5 sans prix API ni benchmarks indépendants. C’est désormais chose faite : 2 $ / 6 $ par million de tokens, soit plus de 60 % moins cher que Claude Opus 4.8 ou GPT-5.5, pour un modèle qu’Elon Musk qualifie de « classe Opus, en plus rapide et moins coûteux ». Le modèle a été entraîné en partie sur des sessions réelles de développeurs Cursor, avec un positionnement clair sur le code et les tâches agentiques. Point de vigilance pour une organisation basée en Suisse : au moment du lancement, Grok 4.5 restait indisponible dans l’API et les produits xAI en zone UE, une extension mi-juillet ayant été annoncée mais pas encore confirmée à ce jour, à vérifier avant tout arbitrage de routage.
Tableau comparatif : les prix API au 19 juillet 2026
| Modèle | Input ($/M tokens) | Output ($/M tokens) | Note |
|---|---|---|---|
| Claude Fable 5 (Anthropic) | 10.00 | 50.00 | add-on crédits |
| GPT-5.6 Sol (OpenAI) | 5.00 | 30.00 | lancé le 09.07 |
| Claude Opus 4.8 | 5.00 | 25.00 | |
| Kimi K3 (Moonshot, Chine, open-weight) | 3.00 | 15.00 | lancé le 16.07 ; cache-hit 0.30 |
| GPT-5.6 Terra | 2.50 | 15.00 | lancé le 09.07 |
| Gemini 3.1 Pro (Google) | 2.00 | 12.00 | double au-delà de 200k de contexte |
| Claude Sonnet 5 | 2.00 | 10.00 | tarif de lancement jusqu’au 31.08, puis 3/15 |
| Grok 4.5 (xAI) | 2.00 | 6.00 | lancé le 08.07 ; prix publié depuis ; UE restreinte |
| Gemini 3.5 Flash | 1.50 | 9.00 | |
| Grok 4.3 / 4.20 (xAI) | 1.25 | 2.50 | contexte 1M |
| GPT-5.6 Luna | 1.00 | 6.00 | lancé le 09.07 |
| Mistral Large 3 | 0.50 | 1.50 | |
| DeepSeek V4 Pro | 0.435 | 0.87 | après la baisse de mai |
| DeepSeek V4 Flash | 0.14 | 0.28 | contexte 1M ; cache jusqu’à −99 % |
Prix relevés le 19 juillet 2026 auprès des pages officielles (Anthropic, OpenAI) et d’agrégateurs spécialisés pour les modèles sans page tarifaire directement accessible.
Anthropic répond par la Bourse, pas par le prix
Plutôt que de suivre la baisse générale, Anthropic a choisi un autre terrain de jeu. La société a déposé le 1er juin un dossier confidentiel d’introduction en bourse (S-1) auprès de la SEC, dans la foulée d’un tour de table de 65 milliards de dollars le 28 mai qui l’a valorisée à 965 milliards de dollars, dépassant pour la première fois OpenAI. Son chiffre d’affaires annualisé aurait franchi les 47 milliards de dollars, porté par l’adoption massive de Claude Code en entreprise. Plusieurs médias rapportent qu’au lieu de baisser ses tarifs face à Grok 4.5 et Kimi K3, Anthropic aurait plutôt assoupli les plafonds d’usage de ses abonnements pour retenir les développeurs, une information non confirmée officiellement à ce stade et à prendre avec prudence.
En face, OpenAI a déposé son propre dossier confidentiel vers le 22 mai, sur la base d’un tour de 110 milliards de dollars conclu fin février à 730 milliards de valorisation (840 milliards post-money), et viserait une entrée en bourse à plus de 1 000 milliards de dollars en septembre. Les deux mêmes entreprises mènent donc, en parallèle, une course à la baisse sur le prix du token et une course à la hausse sur leur propre valorisation, un paradoxe qui n’en est qu’un en apparence : c’est le volume d’usage, pas la marge par token, qui doit convaincre les marchés.
Le compute, angle mort de la baisse des prix
Les prix par token baissent, mais l’infrastructure qui les soutient coûte plus cher. Le marché des GPU de datacenter atteint 48,4 milliards de dollars en 2026, et AWS a relevé de 15 % le tarif de ses instances EC2 Capacity Block premium (le p5e passe de 43,26 $ à 49,75 $/heure en US West). La location d’un H100 se négocie désormais entre 2,01 $ et 11,06 $/heure selon le fournisseur, et posséder ou colocaliser ses GPU reste 40 à 60 % moins cher que le cloud public au-delà de 65-70 % d’utilisation soutenue. Signe des temps côté marchés financiers : Apple a dépassé Nvidia comme entreprise la plus valorisée au monde le 17 juillet, la première fois que le sommet boursier de l’IA n’est pas occupé par un fabricant de puces.
Ce que cela signifie pour une organisation suisse
Trois points d’attention concrets. D’abord, l’open-weight redevient une option crédible : avec Kimi K3 dans le top 4 mondial, l’auto-hébergement souverain n’est plus un compromis de performance, seulement un choix de gouvernance et de conformité. Ensuite, vérifier la disponibilité régionale avant d’arbitrer : Grok 4.5 illustre qu’un prix publié ne garantit pas un accès immédiat depuis la Suisse ou l’UE. Enfin, les engagements tarifaires des éditeurs en course vers une IPO peuvent évoluer vite : une entreprise qui vise une valorisation à mille milliards a des incitations différentes de celle qui vend simplement des tokens, à surveiller dans les prochains mois.
Maîtrisez vos coûts d'IA au lieu de les subir. Comoto OS orchestre les meilleurs modèles du marché, propriétaires ou open-weight, depuis un noyau souverain hébergé en Suisse : chaque tâche routée vers le bon modèle, chaque token tracé, chaque décision auditable.
Découvrir Comoto OSLisez nos prochains papers en avant-première.
Certains articles sont réservés. Laissez votre e-mail pour débloquer l'accès aux prochaines publications de Meotis Research.




