Ce qui se passe
Le 22 septembre 2026, Anthropic a publié Claude Opus 5.5 ; environ une heure plus tard, OpenAI sortait GPT-6 Sol et GPT-6 Luna. La veille étaient arrivés Grok 4.7 et MiMo v2.6. Simon Willison a mis les tarifs côte à côte, et le constat est net : la baisse des prix atteint maintenant le niveau situé juste sous les modèles les plus chers.
Les prix, par million de jetons
| Modèle | Entrée | Entrée en cache | Sortie |
|---|---|---|---|
| GPT-6 Luna | 0,10 $ | 0,01 $ | 0,50 $ |
| GPT-5.6 Luna | 0,20 $ | 0,02 $ | 1,20 $ |
| GPT-6 Sol | 2 $ | 0,20 $ | 10 $ |
| GPT-5.6 Terra | 2 $ | 0,20 $ | 12 $ |
| Grok 4.7 | 2 $ | 0,50 $ | 6 $ |
| Claude Opus 5.5 | 4 $ | 0,20 $ | 20 $ |
| GPT-5.6 Sol | 4 $ | 0,40 $ | 20 $ |
| Claude Fable 5.1 | 10 $ | 0,25 $ | 50 $ |
| GPT-6 Astra | 10 $ | 1 $ | 50 $ |
Ce qu'il faut en lire :
- GPT-6 divise par deux les tarifs de GPT-5.6 — et encore, par rapport à un prix promotionnel : GPT-5.6 doit augmenter de 25 % en novembre. GPT-5.6 Terra, au prix de GPT-6 Sol en entrée, n'a plus guère de raison d'être.
- Opus 5.5 baisse de 20 %, de 5 / 25 $ à 4 / 20 $, premier changement de prix depuis Opus 4.5. Anthropic le présente comme aussi capable que Fable 5.1 et moins cher par jeton qu'Opus 5.
- La lecture du cache d'Opus baisse de 60 %. C'est le poste qui pèse dans les longues sessions d'agent, où plus de 90 % des jetons d'entrée sont facturés au tarif du cache.
En bas de gamme, l'écart est frappant : Claude Haiku 4.5 reste à 1 / 5 $, dix fois le prix de GPT-6 Luna. Anthropic annonce Sonnet 5.5 et Haiku 5.5 prochainement.
La limite : l'effort « max » d'Opus 5.5
Au niveau de réflexion maximal, Opus 5.5 a échoué deux fois de suite sur le test habituel de Simon Willison, un SVG de pélican à vélo : il a atteint la limite de 128 000 jetons de sortie en raisonnant encore, sans rien rendre. Chaque tentative a coûté 2,56 $ et duré près de 20 minutes. Fable 5.1, au même niveau, a abouti. Willison en tire qu'il ne confierait pas de travail sérieux à ce réglage. C'est une observation sur une seule tâche : à vérifier sur ses propres cas avant d'en faire une règle.
Ce que ça change
- Refaire ses calculs de coût, en particulier pour les architectures qui renvoient un long contexte stable à chaque appel : avec un cache à 0,20 $, envoyer tout le contexte plutôt qu'un extrait filtré coûte nettement moins qu'avant.
- Plafonner la sortie et choisir l'effort selon la tâche, plutôt que « max » par défaut.
- Dater ce tableau : Sonnet 5.5, Haiku 5.5 et la hausse de GPT-5.6 le déplaceront encore d'ici quelques semaines.
Simon Willison a basculé ses outils par défaut sur GPT-6 Sol dans Codex et Opus 5.5 dans Claude Code, et sa démo Datasette Agent sur GPT-6 Luna.
Source : Claude Opus 5.5, GPT-6 Sol, GPT-6 Luna, and a new price war, Simon Willison, 22 septembre 2026.