OpenAI baisse de 80 % le prix de son petit modèle IA, trois semaines après son lancement
OpenAI a lancé sa famille de modèles GPT-5.6 le 9 juillet. Le 30 juillet, l'entreprise a divisé par cinq le prix du plus petit des trois. Trois semaines entre les deux. Le temps de finir un pot de yaourt entamé.
Produire l'équivalent de sept romans avec ce modèle coûtait 6 dollars. Désormais, cela coûte 1,20 dollar. Et cette baisse n'a rien d'un cadeau de vacances.
Ce qui a changé, en chiffres
Commençons par un mot qui revient partout : le jeton, ou token en anglais. C'est un morceau de mot que le modèle avale et recrache. Un million de jetons représente, très grossièrement, 700 000 mots. Soit sept ou huit romans. On paie séparément ce qu'on donne à lire au modèle, l'entrée, et ce qu'il écrit, la sortie. La sortie coûte toujours beaucoup plus cher.
Le petit modèle s'est pris les soldes en pleine figure. Le haut de gamme, lui, n'a pas bougé d'un centime.
Voici le détail des trois gammes :
- Luna, le petit modèle rapide : de 1 dollar à 20 centimes en entrée, et de 6 dollars à 1,20 dollar en sortie. Une baisse de 80 %.
- Terra, le modèle de milieu de gamme : de 2,50 dollars à 2 dollars en entrée, et de 15 dollars à 12 dollars en sortie. Une baisse de 20 %.
- Sol, le modèle haut de gamme : toujours 5 dollars en entrée et 30 dollars en sortie. Rien. Pas un centime.
Ce dernier point en dit plus long que les deux autres. Le rayon luxe ne fait pas de soldes tant que personne ne propose la même chose moins cher juste à côté.
L'explication officielle, et celle qu'on devine
OpenAI explique cette baisse par ses progrès techniques : une réduction de 20 % du coût total de fonctionnement, et un gain d'efficacité de plus de 15 % dans la production des jetons. C'est probablement vrai. Mais cela n'explique pas pourquoi le plus petit modèle concentre presque toute la baisse.
L'autre explication tient en un nom : DeepSeek. Sa version V4 Flash coûte 14 centimes en entrée et 28 centimes en sortie. À ce niveau, un modèle facturé 6 dollars par million de jetons en sortie ne peut plus se défendre avec un joli discours. Il doit revoir son étiquette. L'écart de prix sur le marché est devenu franchement absurde. Le plus cher des modèles de pointe coûte 180 dollars par million de jetons produits, contre 28 centimes pour DeepSeek V4 Flash. C'est 643 fois plus cher. Pourtant, dans les deux cas, le client final voit surtout du texte sortir d'une boîte.
Personnellement, je trouve ça sain. Pendant deux ans, on nous a expliqué que l'intelligence artificielle coûtait trop cher pour être bradée. Il aura suffi d'un concurrent sérieux pour que le prix s'effondre en une nuit.
Le vrai bon plan est caché dans la note de bas de page
Il y a mieux que la baisse annoncée, et presque personne n'en parle. GPT-5.6 facture 90 % moins cher un texte qu'il a déjà lu récemment. C'est ce qu'on appelle le cache, une mémoire temporaire qui évite au modèle de relire plusieurs fois la même chose au prix fort.
À gauche, le modèle relit ton dossier depuis la première page à chaque question. À droite, il a posé des marque-pages. La différence se voit surtout en bas de la facture.
Concrètement, quand tu discutes avec un assistant, tout l'historique de la conversation lui est renvoyé à chaque nouveau message. Ta question précédente, sa réponse, le document que tu as collé, tout repart depuis le début. Sans cache, tu paies cette relecture au tarif plein, encore et encore. Avec le cache, la partie qui n'a pas changé passe de 20 centimes à 2 centimes par million de jetons chez Luna.
Il y a une contrepartie honnête à signaler. La première mise en cache d'un texte coûte 1,25 fois le tarif normal. L'opération ne devient donc rentable qu'à partir de la deuxième lecture. Pour une conversation ou un agent, c'est-à-dire un programme qui travaille de manière autonome sur le même dossier pendant une heure, cette deuxième lecture arrive presque tout de suite.
Concrètement, ça change quoi pour toi
Tu ne paies peut-être pas directement OpenAI au million de jetons. Ces tarifs peuvent donc sembler très loin de ton quotidien. Pourtant, ce sont eux qui déterminent les fonctions que les applications peuvent t'offrir, et à quel prix.
Quand la matière première ne coûte presque plus rien, on en met partout. Y compris là où personne n'avait rien demandé.
1. Les fonctions payantes deviennent des fonctions incluses
Une petite entreprise qui vend une application à 3 euros par mois ne peut pas facilement y ajouter une IA qui lui coûte 40 centimes par utilisateur et par mois. Elle réserve cette fonction à un abonnement premium, ou elle s'en passe. Divise ce coût par cinq et le calcul change complètement. La fonction peut alors entrer dans l'offre de base.
C'est ce qui pourrait arriver au résumé de tes mails, à la traduction dans ton application de recettes, à la retouche de photos ou au tri de tes documents. Rien de spectaculaire, pris séparément. Mais des dizaines de petites fonctions peuvent cesser d'être des options payantes.
2. L'IA descend dans les objets qui ne coûtent pas cher
Tant qu'une requête coûte cher, on réserve l'IA aux produits pour lesquels le client paie beaucoup : logiciels d'entreprise, voitures haut de gamme ou abonnements professionnels. À 20 centimes par million de jetons, on peut commencer à en mettre dans une box internet, un interphone, une caisse de supermarché ou un jouet.
C'est la même histoire que celle de la puce électronique. Dans les années 70, un microprocesseur coûtait le prix d'une voiture d'occasion et vivait dans une salle climatisée. Aujourd'hui, il y en a une trentaine dans ta cuisine. La plupart accomplissent des missions aussi glorieuses que faire clignoter l'horloge du four. Quand le prix s'effondre, le produit ne devient pas seulement moins cher. Il apparaît dans des endroits où personne n'aurait pensé à le mettre auparavant.
3. Les factures qui montent vont arrêter de monter
C'est la conséquence la plus terre-à-terre. Si tu paies un abonnement qui utilise de l'IA, ton fournisseur vient peut-être de voir sa propre facture fondre. Il ne te rendra sans doute pas la différence, personne ne fait ça. Mais il pourra arrêter d'augmenter ses prix et se battre sur les fonctions incluses dans son offre.
Gardons une réserve, parce qu'on ne vend pas du rêve. La baisse concerne le petit modèle. Les tâches vraiment difficiles utilisent le haut de gamme, dont le prix n'a pas bougé. Il ne faut donc pas attendre un miracle partout. Les tâches assez simples vont plutôt basculer progressivement vers le petit modèle. Et comme le petit modèle d'aujourd'hui devient rapidement meilleur que le gros d'il y a un an, cela finit par concerner beaucoup de tâches.
Ce que j'en pense
Ce qui me frappe, ce n'est pas le montant de la baisse. C'est le délai. Trois semaines seulement entre le lancement d'un modèle et la division de son prix par cinq. Dans ce secteur, une grille tarifaire a désormais la durée de vie d'une baguette de pain.
Pour ceux qui construisent un produit avec ces outils, la leçon est très concrète : ne jamais bâtir un plan d'affaires sur le tarif du jour, et ne jamais parier sur un seul fournisseur. Le prix va continuer à baisser. Quant au modèle que tu utilises aujourd'hui, il pourrait se retrouver dans le bac à soldes avant Noël.
Pour tous les autres, une bonne nouvelle se cache là-dedans. L'intelligence artificielle, autrefois coûteuse à intégrer dans les services de ton téléphone, est en train d'en devenir l'un des éléments les moins chers. Ce qui restera coûteux, ce sera de savoir quoi en faire.



Rejoignez la conversation
Vous devez avoir un compte pour commenter cet article. La création est gratuite et prend moins d'une minute.
Aucun commentaire pour le moment.