SevenTnewS

Guerre des prix de l'IA

Le prix viral de 0,07 $ du GLM-5.2 de Zhipu aurait déjà été multiplié par 10, selon une réponse

Le GLM-5.2 de Zhipu est devenu viral à 0,07 $ par million de jetons, une baisse de 95 % qualifiée de « presque gratuit » par les internautes. Une réponse affirme que le prix a rebondi de 10 fois, un coup de pub pour attirer les regards. Les praticiens ajoutent que le GLM-5.2 n'a jamais été jugé de niveau de pointe lors des tests.

Emmanuel Fabrice Omgbwa Yasse Assisté par IA

2026-08-10 · 5 min de lecture

Le prix viral de 0,07 $ du GLM-5.2 de Zhipu aurait déjà été multiplié par 10, selon une réponse
Sources : seventnews rela…

Le 10 août 2026, une publication X consacrée à l'actualité de l'IA chinoise a mis un chiffre sur le fil : le modèle GLM phare de Zhipu, affirmait-elle, avait baissé de 95 % et se retrouvait désormais moins cher que DeepSeek. La publication, à l'origine en chinois et traduite par machine, affiche 136 000 vues. Jun Song, dont la bio le présente comme ambassadeur de l'équipe Qwen d'Alibaba, l'a condensée en une phrase : « 0,07 $ par million de jetons. C'est essentiellement utiliser une IA de pointe gratuitement. »

Les réponses ont fait ce que font les réponses. « Baisse de prix incroyable ! » « C'est presque gratuit, vraiment. » Puis une contre-affirmation est tombée, et le fil a cessé d'être une annonce de prix pour devenir une polémique.

Dans cet article :

  • La baisse de 95 % devenue virale
  • Dix fois le prix, et une accusation de coup de pub
  • En cache ou calculé : ce que 0,07 $ achète réellement
  • L'étiquette « de pointe » face aux charges de travail réelles
  • La spirale des prix de l'IA en Chine

La baisse de 95 % devenue virale

Pour comprendre pourquoi cela s'est propagé, il faut regarder le marché environnant. DeepSeek V4 est arrivé à la mi-juillet avec une tarification selon les heures : les coûts doublent pendant les heures de bureau, jusqu'à 1,74 $ par million de jetons de sortie, tandis que les charges de travail hors pointe en cache hit bénéficient du tarif le plus bas. Claude Sonnet 5 a été lancé à 2 $ par million de jetons d'entrée et 10 $ par million de jetons de sortie, des tarifs de lancement qui passent à 3 $ et 15 $ après le 31 août. Face à cela, un modèle phare de Zhipu affiché à 0,07 $ par million de jetons n'est pas une remise. C'est une autre espèce de prix.

C'est pourquoi la publication a circulé. L'affirmation traduite indiquait que le GLM-5.2 se situait désormais en dessous de DeepSeek après une baisse de 95 %, et le calcul de Song la rendait citable en une ligne. Ce que le fil ne montre jamais : la page tarifaire de Zhipu, une annonce officielle, une date d'expiration. C'est une affirmation et son amplification ; la preuve n'apparaît jamais.

Dix fois le prix, et une accusation de coup de pub

La riposte vient de Matt Penny : « Les prix sont remontés à environ 10 fois ce qui est affiché ici. Ils l'ont fait juste pour que les gens créent des publications comme celle-ci et attirent plus de regards. Ils vous ont bien eus. »

Si Penny a raison, le fil se lit différemment. Une baisse de 95 % qui se maintient à 0,07 $ est un titre. Un prix qui descend à 0,07 $ juste assez longtemps pour récolter les publications, puis se stabilise autour de 0,70 $, est un événement publicitaire avec un compteur qui tourne. D'autres réponses ont alimenté cette lecture. Manuel De Ceglie, informé que l'API était désormais moins chère que le plan coding de Zhipu, a répondu : « Vous êtes en train de dire que je paierais moins via l'API qu'avec le plan coding ? C'est fou, l'avoir supprimé était une bonne idée. » Un internaute nommé Darryl a opté pour la blague : « ils ont assez gagné d'argent cette année avec ces hausses de prix du plan coding lol. »

Rien de tout cela ne vérifie quoi que ce soit. Penny est un simple compte sans grille tarifaire jointe, et son affirmation contredit directement la capture d'écran de Song. Mais la contradiction est le contenu : un prix conçu pour convertir, et une accusation selon laquelle cette ingénierie est précisément le but.

En cache ou calculé : ce que 0,07 $ achète réellement

La critique la plus technique est arrivée en lettres capitales, textuellement : « CES PRIX SONT BASÉS SUR DU CACHE OU DU CALCULÉ !!!!! » Cette question détermine si 0,07 $ a un jour été un chiffre réel.

Chaque grande API vend les cache hits à une fraction du prix plein d'un jeton, et la réputation de DeepSeek en matière de cache hit hors pointe repose sur cet écart. Un tarif par jeton sans distinction cache/calculé est une accroche, pas un prix. Kyle Airey a posé l'autre question pratique : le même tarif s'applique-t-il sur Alibaba Cloud, par où transite une grande partie du trafic des modèles chinois ? Le fil ne répond ni à l'une ni à l'autre.

Prix en jeuTarif annoncéSource et statut
GLM-5.2 (affirmation virale)0,07 $ par million de jetonsPublication de Jun Song et affirmation d'une baisse de 95 % par Jason Lee ; non vérifié
GLM-5.2 (contre-affirmation)Environ 10 fois plus après le rebondRéponse de Matt Penny ; non vérifié
DeepSeek V4Jusqu'à 1,74 $ par million de jetons de sortie en heures de bureauCouverture du lancement de V4 par seventnews en juillet 2026
Claude Sonnet 52 $ entrée / 10 $ sortie par million, tarif de lancementAnthropic, jusqu'au 31 août, puis 3 $ / 15 $

L'étiquette « de pointe » face aux charges de travail réelles

La bataille des prix a débouché sur une bataille de la qualité. Bartek Rutkowski a confronté le GLM-5.2 aux charges de travail qu'il traite quotidiennement avec les modèles GPT et Opus : « Avec tout le respect que je vous dois, le GLM-5.2 n'est pas nulle part proche des modèles de pointe. Je me suis laissé prendre par la hype, je l'ai testé sur les charges de travail que je traite quotidiennement avec les modèles GPT/Opus et j'ai très vite écarté le GLM-5.2, estimant qu'il ne valait ni l'argent ni le temps. » La double négation est de son cru. Sergio Suave s'est montré plus mesuré : « Le GLM 5.2 est bien en dessous de l'IA de pointe, mais la nouvelle tarification reste plutôt bonne. »

Ce que « de pointe » signifie en ce moment est vérifiable. Dans notre tour d'horizon des benchmarks mathématiques, GPT-5.4 et GPT-5.2 Pro atteignent tous deux 99 sur AIME 2025 et 97 sur HMMT 2025, avec Claude Opus 4.6 et Grok 4.1 dans le même classement. Le GLM-5.2 n'y figure pas. À 0,07 $, vous achetez quelque chose ; les réponses disent que ce n'est pas le sommet du classement.

La spirale des prix de l'IA en Chine

Prenez du recul et le fil s'inscrit dans un schéma. Le M3 de MiniMax est en open weight et tarifé pour sous-coter les API occidentales : son niveau Ultra coûte 469 ¥/mois (environ 65 $) pour 5,5 milliards de jetons, soit environ trois fois la capacité du Claude Max à 200 $/mois pour environ un tiers du prix. DeepSeek V4 Pro sous-cote GPT-5.5 d'environ 9 fois sur le prix de sortie, sous licence MIT. Les modèles Qwen d'Alibaba Cloud sont cités comme particulièrement populaires au Japon et en Corée du Sud pour leurs performances dans les langues locales. Dans ce marché, un modèle phare à 0,07 $ est plausible. Un modèle phare qui affiche 0,07 $ pour générer la publication est tout aussi plausible.

TendiesOfWisdom a ajouté l'objection standard : « Ce tarif envoie toutes vos données en Chine. » Mème ou inquiétude, cela fait partie des raisons pour lesquelles un modèle chinois bon marché circule si vite sur un fil anglophone.

Le fil se referme là où il s'est ouvert, sur un prix que personne ne peut confirmer. Une réponse traite le GLM-5.2 comme un accès quasi gratuit à des capacités de pointe ; une autre qualifie le prix de théâtre ; une troisième affirme que le modèle n'a jamais été de pointe, tout simplement. Ils s'accordent sur une chose : le prix est l'histoire, et c'est l'histoire qui vend. « Ils vous ont bien eus », a écrit Penny. Si la grille tarifaire de Zhipu dit le contraire, personne dans ce fil ne l'a jointe.

L'essentiel de la tech en 3 minutes chaque matin

Un email, chaque jour ouvré, avec ce qui compte vraiment en IA et en tech.