OpenAI réduit de 80 % le prix du GPT-5.6 Luna alors que les modèles chinois les moins chers se rapprochent OpenAI vient de réduire de 80 % le prix de son modèle GPT-5.6 le moins cher, trois semaines après le lancement – le signal le plus clair à ce jour que l'entreprise qui a lancé le…
OpenAI vient de réduire de 80 % le prix de son modèle GPT-5.6 le moins cher, trois semaines après son lancement – le signal le plus clair à ce jour que l’entreprise qui a lancé le boom de l’IA générative est entraînée dans une guerre des prix qu’elle n’a pas déclenchée.
Jeudi, la société a déclaré que GPT-5.6 Luna, son modèle axé sur la vitesse, coûte désormais 20 cents par million de jetons d’entrée et 1,20 $ par million de jetons de sortie, contre 1 $ et 6 $. GPT-5.6 Terra, le modèle de niveau intermédiaire, obtient une réduction de 20 % à 2 $ par million de jetons d’entrée et 12 $ par million de sortie. Le prix du produit phare GPT-5.6 Sol reste inchangé.
« Notre stratégie reste axée sur l’amélioration des capacités et de l’efficacité afin que chaque génération d’intelligence puisse accomplir davantage de travail à moindre coût », a déclaré OpenAI dans son communiqué.
Cette décision intervient alors que les entreprises qui encourageaient autrefois le « tokenmaxxing » sans contrainte ont commencé à examiner attentivement les factures d’IA qui s’élèvent parfois à des milliards. Les entreprises veulent des rendements plus clairs avant de s’engager dans les modèles les plus chers, et elles disposent désormais de plus d’alternatives qu’au début de l’ère ChatGPT.
OpenAI présente les réductions comme le fruit d’un travail d’efficacité plutôt que d’un sacrifice de marge – un jour plus tôt, la société a déclaré que GPT-5.6 avait contribué à rendre son fonctionnement moins cher, et elle répercutait ces gains sur la façon dont l’utilisation est comptabilisée dans les abonnements Codex et ChatGPT Work, avec des prix plus bas déployés également sur AWS.
Les modèles chinois à poids ouvert ont rapidement comblé l’écart. Le Kimi K3 de Moonshot AI, lancé plus tôt ce mois-ci, a battu certains des principaux systèmes propriétaires selon les critères de référence du secteur et peut être exécuté sur la propre infrastructure d’une entreprise. Cette évolution a contribué à susciter une série de réponses concurrentielles.
Il est difficile de surestimer l’ampleur du défi. Avec 2,8 billions de paramètres, K3 est le plus grand modèle ouvert jamais publié, et les tests aveugles des développeurs l’ont placé à la première place dans le domaine du codage frontal de LMArena, devant Claude Fable 5, la frontière d’Anthropic. La demande a été suffisamment forte pour que Moonshot ait plafonné les nouveaux abonnements et l’accès aux API en raison des contraintes de capacité, et le chiffre d’affaires quotidien de la société a été multiplié par six depuis son lancement alors qu’elle cherche une valorisation de 50 milliards de dollars avant une éventuelle introduction en bourse à Hong Kong. Les données économiques en dessous sont brutales : selon l’indice de coût par tâche d’Artificial Analysis, K3 accomplit une tâche pour 94 cents et DeepSeek V4 Pro pour quatre cents, contre 1,04 $ pour le produit phare d’OpenAI, Sol et 1,80 $ pour Claude Opus 4.8 d’Anthropic – et Moonshot rapporte des taux d’accès au cache supérieurs à 90 % dans les charges de travail de codage, ce qui réduit le coût d’entrée effectif de K3 à 30 cents par million.
Anthropic a suivi avec Claude Opus 5, qu’il présente comme se rapprochant des performances de son modèle haut de gamme Fable 5 à moitié prix – et le battant carrément sur certains points de référence en matière de connaissances – tout en conservant la même grille tarifaire que son prédécesseur Opus 4.8. Microsoft a fait la promotion de ses propres modèles moins chers, notamment MAI-Cyber-1-Flash, une nouvelle offre axée sur la cybersécurité qui, selon Mustafa Suleyman, responsable de l’IA, offre « des performances de pointe à 50 % du coût ». Google, quant à lui, a lancé ce mois-ci trois nouveaux modèles Gemini Flash et a affirmé que son modèle Flash le plus performant sape le Kimi K3 et d’autres systèmes chinois sur une base par tâche.
[…] La suite de l’article est à lire sur ZeroHedge via le lien ci-dessous.
Traduit automatiquement de l’anglais. Le texte original fait foi.
Source : ZeroHedge — Lire l’article original
