Le . 9 min. de lecture.

Opus 5.5 et GPT-6 Sol baissent les prix mais pas la facture

Opus 5.5 coûte 20 % de moins qu’Opus 5, GPT-6 Sol moitié moins que son aîné, depuis le 22 septembre 2026. Les modèles phares, eux, n’ont pas bougé d’un cent.

Mardi 22 septembre, en fin de journée à Paris, Anthropic a publié Claude Opus 5.5. OpenAI a répondu le soir même avec deux modèles, GPT-6 Sol et GPT-6 Luna1. Les deux communiqués promettaient des modèles plus capables, comme d’habitude. Ils promettaient surtout des modèles moins chers, et c’est le chiffre que les deux maisons ont mis en avant.

Opus 5.5 coûte 4 dollars le million de jetons2 en entrée et 20 en sortie, 20 % de moins qu’Opus 53. GPT-6 Sol descend à 2 et 10 dollars, deux fois moins que GPT-5.6 Sol, et Luna à 10 et 50 centimes4. La course aux performances se double donc d’une guerre des prix. Elle se livre pourtant un étage sous le sommet, et le prix du jeton ne dit pas grand-chose de ce que paie le client à la fin.

Un soleil éclatant en haut à gauche et un croissant de lune en bas à droite, sur un ciel noir semé d’étoiles, encadrent l’inscription GPT-6 Sol and Luna.
Le visuel officiel de GPT-6 Sol et Luna. OpenAI baisse ses prix, pas son budget d’astronomie (image OpenAI).

Le niveau du grand frère au prix du petit

Les deux annonces vendent la même promesse, celle du modèle phare à un prix de milieu de gamme. Anthropic écrit qu’Opus 5.5 « se hisse au niveau de Claude Fable 5.1 sur la plupart des tâches » et coûte 40 % de moins qu’Opus 5 sur un travail ordinaire3. Ses propres tests le placent même devant Fable en code piloté par agent, avec 66,4 % sur Terminal-Bench 4.0 contre 55,8 %5. OpenAI, de son côté, affirme que Sol commet moitié moins d’erreurs que son prédécesseur et atteint « la fiabilité d’Astra pour un coût bien moindre »1.

La comparaison qu’OpenAI met en avant vise directement le concurrent. Sur AutomationBench, Sol battrait Claude Opus 5 pour un coût 11,1 fois plus bas, et sur OSWorld 2.0, qui mesure l’usage d’un ordinateur, il l’égalerait pour 80 % de moins6. Le rival cité est Opus 5, qu’Anthropic venait de remplacer le jour même. Préparer un argumentaire tarifaire prend manifestement plus de temps que de sortir un modèle.

Chez OpenAI, la baisse ne date pas d’hier. En juillet, GPT-5.6 Sol sortait à 5 dollars en entrée et 30 en sortie, et j’écrivais qu’OpenAI visait le roi au portefeuille. Depuis, le même modèle est passé à 4 et 20 dollars, un tarif promotionnel garanti au moins jusqu’au 21 novembre7. Le nouveau Sol s’affiche à 2 et 10 dollars, et OpenAI précise que ce prix est permanent8. Le prix de sortie du modèle vedette d’OpenAI a donc été divisé par trois en deux mois et demi.

Le sommet n’a pas bougé d’un cent

Il suffit de regarder un étage plus haut pour voir la limite de cette guerre. Claude Fable 5.1 et GPT-6 Astra, les deux modèles phares et les plus chers qu’on puisse acheter, restent au même tarif, 10 dollars en entrée et 50 en sortie, et ce sont les seuls que la bataille du 22 septembre n’a pas touchés9. Plus haut encore, Mythos et la version complète d’Astra restent sous clé, comme je le racontais début septembre. Opus 5.5 lui-même garde une laisse. Quand ses garde-fous se déclenchent sur une tâche de cybersécurité ou de biologie, la requête bascule vers Opus 4.8, un modèle plus ancien3.

La course aux performances n’a donc pas cessé. Elle se poursuit au sommet, au prix fort et derrière une porte, pendant que l’étage du dessous brade le niveau que le sommet avait atteint quelques semaines plus tôt. C’est d’ailleurs la première sortie d’Anthropic depuis que Dario Amodei a demandé de rythmer la frontière, et elle est cohérente avec son essai, puisqu’elle ne repousse aucune frontière et rend seulement l’existant moins cher. Ralentir le sommet et solder l’étage d’en dessous vont très bien ensemble, surtout quand l’entreprise prépare son introduction en Bourse10.

Le jeton baisse, la facture suit si on la surveille

Pour qui paie à l’usage, le prix affiché compte moins que le nombre de jetons que le modèle dépense pour finir une tâche. Or ce nombre dépend d’un réglage que chacun choisit, l’effort de raisonnement11. Artificial Analysis, qui fait passer la même batterie d’épreuves à tous les modèles, chiffre le même GPT-6 Sol à 0,13 dollar la tâche en effort bas et 1,06 dollar en effort maximal, huit fois plus12. Opus 5.5, lui, a produit 260 millions de jetons de sortie pour boucler ces épreuves, quand la médiane des modèles testés tourne à 88 millions13. Un jeton moins cher chez un modèle bavard ne fait pas forcément une facture plus légère.

Les 40 % d’économie annoncés par Anthropic méritent la même lecture. Ils supposent de passer du réglage par défaut d’Opus 5, un effort élevé, à celui d’Opus 5.5, un effort moyen14. Une partie de la baisse vient donc d’un modèle qui réfléchit moins longtemps quand on ne lui demande rien, ce qui peut suffire ou non selon la tâche. Simon Willison, un développeur qui passe chaque nouveau modèle au banc d’essai, a vu ses essais d’Opus 5.5 en effort maximal coûter 2,56 dollars pièce, tourner 20 minutes et buter sur le plafond de sortie avant d’avoir fini9.

La baisse la plus utile se cache dans une ligne plus discrète. Relire un contexte déjà mis en cache15 coûte désormais 20 centimes le million de jetons chez Anthropic, contre 50 avec Opus 53. Un agent qui relit cent fois le même code au cours d’une séance paie surtout cette ligne-là, bien plus que le prix affiché en tête du communiqué.

L’abonné garde le même ticket

Aucune des deux annonces ne touche au prix des abonnements. Anthropic relève les limites de consommation sur cinq heures des formules Pro, Max et Team, et offre à chaque abonné une remise à zéro de ces limites à utiliser quand il le souhaite3. OpenAI ouvre Sol aux abonnés Plus et au-delà, et Luna aux comptes gratuits dans son application de bureau4. L’abonné en reçoit donc davantage pour le même prix, alors que la baisse chiffrée va aux entreprises et aux développeurs qui paient au jeton.

J’en fais partie, de ces abonnés. Mon abonnement Anthropic me coûte ce qu’il me coûtait lundi, et la guerre des prix m’y donne un peu plus de marge avant de percuter le plafond. Je ne m’en plains pas.

Les laboratoires chinois cassaient déjà les prix

La guerre des prix n’a pas commencé en Californie. DeepSeek facture son V4 Pro 1,32 dollar le million de jetons en entrée et 3,96 en sortie aux heures de pointe, moitié moins le reste du temps, soit encore moins cher que le nouveau Sol16. Les modèles ouverts chinois tiennent même dans une carte graphique de joueur, Qwen en tête. Avec Luna, OpenAI passe sous certains d’entre eux, 29 % sous le MiMo de Xiaomi sur le prix d’entrée8. Il y a une ironie là-dedans, puisque les laboratoires chinois ont appris en partie en copiant Claude. Les Américains répondent maintenant par le prix à des concurrents qu’ils ont involontairement formés.

Reste un paradoxe que ni OpenAI ni Anthropic n’expliquent vraiment. La mémoire n’a jamais coûté aussi cher, les fabricants ont vendu d’avance leur production de 2027, et le prix du jeton baisse quand même. OpenAI invoque des progrès sur le cache et l’inférence1. Une partie de la réponse tient sans doute à la concurrence elle-même. Quand deux entreprises lancent leurs modèles le même soir, aucune ne peut se permettre de garder ses anciens tarifs.

Anthropic promet Sonnet 5.5 et Haiku 5.5 dans les semaines qui viennent3, si bien que le prochain round se jouera encore plus bas dans la gamme. Je guetterai plutôt le jour où un Fable ou un Astra passera sous les 10 dollars. Ce jour-là, la course aux performances aura vraiment ralenti. D’ici là, les deux rivaux vendent au rabais ce qu’ils avaient de meilleur le mois dernier et gardent le reste sous clé.

Notes

  1. TechCrunch, « OpenAI launches GPT-6 Sol and Luna, boasting lower cost and fewer mistakes » (en anglais), 22 septembre 2026. ↩ ↩2 ↩3

  2. Le jeton est l’unité de texte que le modèle lit et produit, un mot ou un morceau de mot. Les éditeurs facturent au million de jetons, plus cher en sortie qu’en entrée, puisque produire du texte demande plus de calcul que le lire. ↩

  3. Anthropic, « Introducing Claude Opus 5.5 » (en anglais), 22 septembre 2026. ↩ ↩2 ↩3 ↩4 ↩5 ↩6

  4. OpenAI, « Introducing GPT-6 Sol and Luna » (en anglais), 22 septembre 2026. ↩ ↩2

  5. VentureBeat, « Anthropic releases Claude Opus 5.5, beating Fable 5.1 on key agentic benchmarks at 60% cheaper API price » (en anglais), 22 septembre 2026. ↩

  6. MarkTechPost, « OpenAI Releases GPT-6 Sol and Luna » (en anglais), 22 septembre 2026. Les mesures sont celles d’OpenAI. ↩

  7. OpenAI, fiche de GPT-5.6 Sol et fiche de GPT-6 Sol (en anglais), consultées le 23 septembre 2026. ↩

  8. VentureBeat, « OpenAI releases GPT-6 Sol and Luna models, slashing API costs 50% or more » (en anglais), 22 septembre 2026. ↩ ↩2

  9. Simon Willison, « Claude Opus 5.5, GPT-6 Sol, GPT-6 Luna, and a new price war » (en anglais), 22 septembre 2026. ↩ ↩2

  10. Bloomberg, « Anthropic Unveils More Cost-Efficient Opus 5.5 Model Before IPO » (en anglais), 22 septembre 2026. ↩

  11. L’effort de raisonnement règle combien de temps le modèle réfléchit avant de répondre. Plus il réfléchit, plus il écrit de jetons qu’on ne lit jamais et qu’on paie quand même. ↩

  12. Artificial Analysis, page de GPT-6 Sol (en anglais), consultée le 23 septembre 2026. ↩

  13. Artificial Analysis, page de Claude Opus 5.5 (en anglais), consultée le 23 septembre 2026. ↩

  14. Digital Applied, « Claude Opus 5.5: Pricing, Benchmarks and Breaking Changes » (en anglais), septembre 2026. ↩

  15. Le cache garde en mémoire un texte que le modèle a déjà lu, un long document ou tout le code d’un projet, pour qu’il le relise sans tout retraiter. L’éditeur facture cette relecture bien moins cher qu’une lecture neuve. ↩

  16. DeepSeek, grille tarifaire de l’API (en anglais), consultée le 23 septembre 2026. Les heures de pointe tombent en semaine, de 3 h à 6 h et de 8 h à midi, heure de Paris. ↩

À lire aussi…

  1. Mistral lève trois milliards quand Anthropic en lève 65

  2. Nvidia achète Hugging Face et la France n’avait rien à vendre

  3. L’IA locale vient de Chine et tient dans ma carte graphique