OpenAI casse ses prix de 80 % : même le leader fermé tombe au niveau de l'open-weight (refais ton calcul)
Le 30 juillet, OpenAI a baissé GPT-5.6 Luna de 80 % — 0,20 $ le million de tokens en entrée. Un modèle de la famille frontière au prix des open-weights, et financé par de vraies économies (l'IA a réécrit ses propres kernels GPU). Pour un solo, le message est limpide : le prix plancher continue de tomber, même chez les fournisseurs fermés. Ta facture doit suivre.
On t’a montré, il y a quelques jours, que le prix de l’IA s’effondrait — surtout côté open-weight. Cette fois, c’est le leader fermé lui-même qui casse les prix. Le 30 juillet, OpenAI a baissé ses deux modèles GPT-5.6 les moins chers : Luna chute de 80 %, à 0,20 $ le million de tokens en entrée. Un modèle de la famille frontière au niveau de prix des open-weights. Et ce n’est pas une promo à perte. Pour un solo, c’est un signal clair : refais ton calcul.
Ce qui s’est passé
OpenAI a réduit GPT-5.6 Luna (le modèle d’entrée) de 80 % — de 1 $ / 6 $ à 0,20 $ en entrée et 1,20 $ en sortie par million de tokens — et Terra (milieu de gamme) de 20 %. Le flagship Sol reste, lui, à 5 $ / 30 $. Autrement dit, OpenAI défend agressivement le tier du volume (là où se dépense l’essentiel des budgets IA) tout en protégeant la marge du haut de gamme.
Le détail qui rend ça durable : ce n’est pas une remise à perte. OpenAI dit avoir réduit ses coûts de service d’environ 20 % grâce à des optimisations — et, fait notable, son propre modèle (Sol, via son outil de code) a réécrit ses kernels GPU pour se rendre moins cher à faire tourner. La baisse est financée par de vraies économies, pas par du sacrifice de marge temporaire. C’est la suite logique de l’effondrement des prix de l’IA, mais venue cette fois du camp propriétaire.
Ce que ça veut dire
Deux choses. Un : le prix plancher d’un modèle capable continue de tomber, y compris chez les fournisseurs fermés — pas seulement chez les open-weights chinois. La pression est générale et elle joue pour toi. Deux : parce que la baisse vient de vrais gains d’efficacité, elle est probablement durable, pas un coup de communication qui remontera dans trois mois.
Concrètement, un modèle « frontière light » à 0,20 $ change la rentabilité de plein d’usages qui étaient à la limite. Continuer à faire passer tout ton travail par un modèle premium « à tout faire », c’est désormais payer le prix fort pour des tâches qui ne le méritent pas.
Ce que tu fais lundi matin
Trois réflexes.
Audite ta facture IA, encore. On le répète parce que les prix bougent vite : liste ce que tu paies et pour quoi. Le volumineux et le routinier (reformuler, résumer, classer, extraire) peut basculer sur un modèle à 0,20 $ sans que tu perdes en qualité utile. C’est de l’argent récupéré immédiatement.
Route tes tâches. Envoie le volume vers le bon marché (Luna ou équivalent), et garde le flagship (Sol, Opus 5…) pour les tâches vraiment dures. C’est l’exact esprit de la stack minimale bien pensée : le bon modèle au bon prix pour chaque usage, pas le plus cher partout.
Reste mobile. Ne verrouille pas ton process sur un seul fournisseur : la guerre des prix veut dire que le meilleur rapport qualité/prix change tous les mois. Garder la capacité de switcher, c’est ce qui te protège — le revers du risque de dépendance qu’on décrivait avec le financement circulaire.
Le piège à éviter
Le piège : choisir le moins cher pour tout, aveuglément. Un modèle à 0,20 $ est parfait pour le volume, pas forcément pour tes tâches les plus exigeantes ou celles où l’erreur coûte cher. Le prix est un critère, pas le seul. Garde un modèle solide pour le difficile.
L’autre piège : ne rien changer parce que « ça marche ». Si tu n’as pas rouvert ta facture IA depuis un mois, tu paies probablement trop — le marché a bougé sous tes pieds. Le bon réflexe n’est pas de tout casser à chaque annonce, c’est de ré-arbitrer régulièrement : la puissance devient une commodité, ne la paie pas au prix d’hier.


