DeepSeek et Xiaomi cassent les prix de l’IA face aux labs US

Date:

Des baisses de prix qui rebattent les cartes

Le marché de l’IA entre dans une phase de forte pression sur les coûts. DeepSeek a rendu permanent son rabais de 75 % sur V4-Pro, tandis que Xiaomi a réduit jusqu’à 99 % le prix de son modèle MiMo-V2.5 pour certains usages. Ces décisions changent immédiatement la donne pour les entreprises qui consomment des modèles via API, car le prix d’un modèle n’est plus seulement un détail technique : il devient un facteur stratégique de rentabilité.

Pourquoi le prix au token compte autant

Quand un utilisateur consulte un chatbot dans un navigateur, il paie souvent un abonnement fixe. En revanche, une entreprise qui intègre un modèle dans une application paie généralement au token, une unité de texte proche d’une fraction de mot. Chaque requête, chaque réponse et chaque document analysé consomment des tokens. À grande échelle, cette mécanique peut faire basculer un produit entre viabilité économique et coût insoutenable.

  • Input tokens : le texte envoyé au modèle.
  • Output tokens : le texte généré par le modèle.
  • Cache hits : les contenus déjà vus, réutilisés à moindre coût.

Xiaomi et DeepSeek misent sur l’efficacité

Le cas de Xiaomi illustre une optimisation très concrète : plus le système réutilise intelligemment les informations déjà traitées, plus la facture baisse. Fuli Luo, responsable de l’équipe MiMo et ancien développeur clé de DeepSeek-V2, explique que l’architecture de stockage réduit fortement les calculs inutiles. Dans ce cadre, le service peut accepter davantage de charge tout en restant proche du point mort financier, ce qui montre que la baisse de prix n’est pas une simple opération marketing.

  • Le système supporte une gestion plus efficace du KV cache.
  • Le stockage interne peut conserver environ cinq fois plus de données.
  • Les coûts de calcul et de stockage peuvent chuter d’environ 80 %.

Des chiffres spectaculaires pour les entreprises

Les nouveaux tarifs sont particulièrement impressionnants pour les usages répétés. DeepSeek V4-Pro est désormais affiché à 0,435 $ par million de tokens en entrée et 0,87 $ en sortie. MiMo-V2.5-Pro adopte un niveau comparable, avec des cache hits à seulement 0,0036 $ par million de tokens. À ce niveau, l’IA devient beaucoup plus accessible pour des produits qui traitent de grands volumes de texte.

  • 82 milliards de tokens peuvent être obtenus avec certains abonnements haut de gamme chez Xiaomi.
  • Ce volume représente plus de 60 milliards de mots.
  • Les usages les plus favorables sont les agents IA, les outils de recherche documentaire et les systèmes à prompts stables.

Les laboratoires américains suivent une trajectoire différente

Alors que les acteurs chinois baissent leurs prix, certains modèles américains avancent dans l’autre direction. GPT-5.5 a doublé le coût de sortie à 30 $ par million de tokens, tandis que Claude Opus 4.7 s’affiche à 5 $ pour l’entrée et 25 $ pour la sortie. Anthropic a certes maintenu sa grille tarifaire, mais son nouveau tokenizer peut produire jusqu’à 35 % de tokens supplémentaires pour le même texte, ce qui peut alourdir la facture réelle.

  • Gemini 2.5 Pro reste plus modéré côté prix, avec 1,25 $ en entrée et 10 $ en sortie.
  • Les écarts de coût entre modèles peuvent atteindre 15 à 30 fois.
  • Pour des tâches répétitives, la différence de prix devient décisive.

Une guerre de performance, de coût et d’adoption

Le point le plus intéressant n’est pas seulement la baisse tarifaire, mais le fait qu’elle s’accompagne d’une performance élevée. DeepSeek V4-Pro, avec ses 1,6 trillion de paramètres, affiche une qualité proche de Claude Opus 4.6 sur des benchmarks de code, tout en restant bien moins cher. De son côté, MiMo-V2.5 s’inscrit dans la même logique : rendre les modèles de pointe exploitables à grande échelle, sans sacrifier la compétitivité technique.

  • Les benchmarks de type SWE-Verified mesurent des tâches proches du monde réel.
  • Les économies les plus fortes concernent les systèmes qui réutilisent beaucoup de contexte.
  • Pour les éditeurs d’applications IA, le coût du token devient un levier d’adoption massive.

En savoir plus sur L'ABESTIT

Subscribe to get the latest posts sent to your email.

Share post:

Popular

More like this
Related

Vigilance orange orages dans le Sud-Ouest et l’arc méditerranéen

« Un épisode pluvio-orageux bien actif est attendu sur une large partie sud du pays lundi », a annoncé Météo-France, ajoutant que cette « dégradation orageuse » devrait ensuite toucher l’arc méditerranéen en fin d’après-midi....

Israël met en garde le Hamas après des cerfs-volants lancés de Gaza

« C’est la responsabilité de l’armée d’agir à temps », a déclaré de son côté Uri Epstein, un représentant des communautés qui vivent proches de la frontière avec Gaza, et dont beaucoup ont été attaquées lors de l’attaque du Hamas le 7 octobre 2023....

Léa Salamé quitte le 20 heures après la candidature Glucksmann

Conformément à l’engagement pris dès son arrivée au JT de France Télévisions en 2025, la journaliste tire les conséquences de l’officialisation de la candidature de son compagnon à la présidentielle, et renonce à présenter le rendez-vous phare de l’information de service public....

Un homme meurt après un accident sur une route d’Agde

Un accident a eu lieu samedi 22 août au matin sur une route départementale à Agde. Deux voitures à 80 km/h se sont percutées. Un homme a dû être désincarcéré, il est mort des suites de ses blessures dans l'après-midi à l'hôpital....