← Back to articles
GPT-5.6 Luna gratuit vs DeepSeek, MiniMax et ByteDance : la guerre des prix s'accélère

GPT-5.6 Luna gratuit vs DeepSeek, MiniMax et ByteDance : la guerre des prix s'accélère

OpenAI vient de faire de GPT-5.6 Luna son modèle par défaut gratuit pour ChatGPT, après une baisse de 80 % des prix API. Résultat : Luna passe sous DeepSeek V4 Pro sur l'input, la pression sur le rapport qualité/prix chinois monte d'un cran. Décryptage d'une bascule stratégique.

By Équipe Gennn··3 min read

Fin juillet, OpenAI a taillé 80 % dans les tarifs API de son modèle grand public GPT-5.6 Luna. Nouveau prix : 0,20 $ par million de tokens en entrée, 1,20 $ en sortie. Trois semaines plus tard, la conséquence logique tombe : Luna devient le modèle par défaut de ChatGPT gratuit pour les utilisateurs « Free » et « Go ». Chats textuels illimités au menu.

Ce n'est pas une baisse tarifaire de plus. C'est une bascule stratégique qui reconfigure toute la couche « modèles pas chers » du marché — là où DeepSeek, MiniMax et ByteDance dominaient jusqu'ici la conversation grâce à leurs poids ouverts et à des grilles agressives.

Le nouveau positionnement de Luna

Avec 0,20 $/M en entrée, Luna se glisse dans le tier bas du marché, celui peuplé par les petits modèles chinois open-weights et par les propositions frugales de Google (Gemini 3.5 Flash à 0,15 $/M) et Xiaomi. La bascule est nette :

  • 0,20 $ vs 0,435 $ pour DeepSeek V4 Pro (avec sa promotion permanente de 75 %) : Luna passe devant en input
  • 1,20 $ vs 0,87 $ en sortie : DeepSeek reste moins cher en output

Le calcul « build vs buy » pour beaucoup d'usages entreprise — triage de tickets, génération de premier jet, classification simple — bascule. Là où l'auto-hébergement d'un DeepSeek open-weights avait un vrai avantage économique, il faut désormais y regarder à deux fois.

Il y a un mois, aucun modèle propriétaire d'un grand laboratoire américain n'était compétitif face à DeepSeek. Aujourd'hui, Luna l'est — et il vient avec l'infra OpenAI, l'écosystème, le SLA.

La réplique chinoise : quasi-instantanée

DeepSeek a répliqué le même jour avec le lancement de V4 Flash, une variante MoE de 284 milliards de paramètres (13 milliards actifs par token), positionnée agressivement en rapport qualité / prix. MiniMax et ByteDance Seedance 2.5 tiennent leur cap sur les segments vidéo et multimodal, avec des tarifs 5 à 7× inférieurs aux équivalents occidentaux.

Selon plusieurs analystes cités par MLQ News et VentureBeat, on entre dans une guerre des prix prolongée pour la seconde moitié de 2026. La Chine mise sur l'ouverture (poids téléchargeables, licence permissive), OpenAI mise sur l'intégration verticale et la distribution massive via ChatGPT.

La distribution comme arme

Rendre Luna gratuit dans ChatGPT est un mouvement plus profond qu'une simple opération marketing. OpenAI capte ainsi la donnée d'usage de son modèle sur des centaines de millions de nouvelles requêtes quotidiennes — ce que ne peut faire aucun modèle chinois hébergé chez un tiers.

Deux effets attendus :

  1. Fine-tuning implicite continu. Chaque interaction avec Luna (feedback like/dislike, reformulation, abandon) enrichit les corpus RLHF d'OpenAI. Le modèle s'améliore même sans nouvelle version.
  2. Verrouillage de l'écosystème. Un utilisateur qui prend l'habitude d'utiliser Luna gratuitement via ChatGPT ne va pas basculer chez DeepSeek pour son usage perso. La bataille B2C se joue sur l'expérience, pas sur les benchmarks.

Sur les benchmarks de code : la Chine tient encore

Le comparatif DeepSWE mené par Together.ai le montre : sur les tâches de code long-contexte, DeepSeek V4 Flash reste devant Luna à coût comparable. Traduction : sur les workloads développeurs sophistiqués, l'écosystème chinois n'a pas perdu.

C'est plutôt sur les usages grand public et B2B généralistes (support, contenu, classification, extraction, résumé) que Luna devient imbattable. La segmentation du marché s'accentue.

Qui perd, qui gagne

  • OpenAI gagne en base d'utilisateurs — objectif clair : consolider le milliard d'utilisateurs actifs et empêcher DeepSeek de venir grignoter le grand public.
  • Anthropic n'est pas dans cette guerre et l'assume : Claude Sonnet 5 reste à 3 $ / 15 $ par million, positionné qualité premium pour les usages entreprise.
  • Google est piégé : Gemini 3.5 Flash est déjà agressif mais le report de Gemini 3.5 Pro l'empêche de contre-attaquer sur le haut de gamme.
  • Les fournisseurs cloud (Together.ai, Fireworks, DeepInfra) voient leur proposition « héberge un modèle open-weights pour toi » s'effriter sur les gros volumes.

Ce qu'il faut retenir

Il y a trois lignes de front désormais bien tracées :

  • Le grand public gratuit — dominé par ChatGPT (Luna) et Gemini, avec Claude en outsider premium
  • Les workloads dev / code / agents — où DeepSeek et Claude gardent l'avantage qualitatif
  • La vidéo et multimodal grand public — dominé par les modèles chinois (Seedance, MiniMax H3) à cause du différentiel de prix

Une chose est sûre : la marge unitaire de l'industrie IA en 2026 s'écrase. Les gagnants économiques ne seront pas ceux qui font le meilleur modèle, mais ceux qui savent distribuer massivement et intégrer profondément. OpenAI joue cette carte à fond.