DeepSeek et Xiaomi cassent les prix de l’IA face aux labs US

Date:

Des baisses de prix qui rebattent les cartes

Le marché de l’IA entre dans une phase de forte pression sur les coûts. DeepSeek a rendu permanent son rabais de 75 % sur V4-Pro, tandis que Xiaomi a réduit jusqu’à 99 % le prix de son modèle MiMo-V2.5 pour certains usages. Ces décisions changent immédiatement la donne pour les entreprises qui consomment des modèles via API, car le prix d’un modèle n’est plus seulement un détail technique : il devient un facteur stratégique de rentabilité.

Pourquoi le prix au token compte autant

Quand un utilisateur consulte un chatbot dans un navigateur, il paie souvent un abonnement fixe. En revanche, une entreprise qui intègre un modèle dans une application paie généralement au token, une unité de texte proche d’une fraction de mot. Chaque requête, chaque réponse et chaque document analysé consomment des tokens. À grande échelle, cette mécanique peut faire basculer un produit entre viabilité économique et coût insoutenable.

  • Input tokens : le texte envoyé au modèle.
  • Output tokens : le texte généré par le modèle.
  • Cache hits : les contenus déjà vus, réutilisés à moindre coût.

Xiaomi et DeepSeek misent sur l’efficacité

Le cas de Xiaomi illustre une optimisation très concrète : plus le système réutilise intelligemment les informations déjà traitées, plus la facture baisse. Fuli Luo, responsable de l’équipe MiMo et ancien développeur clé de DeepSeek-V2, explique que l’architecture de stockage réduit fortement les calculs inutiles. Dans ce cadre, le service peut accepter davantage de charge tout en restant proche du point mort financier, ce qui montre que la baisse de prix n’est pas une simple opération marketing.

  • Le système supporte une gestion plus efficace du KV cache.
  • Le stockage interne peut conserver environ cinq fois plus de données.
  • Les coûts de calcul et de stockage peuvent chuter d’environ 80 %.

Des chiffres spectaculaires pour les entreprises

Les nouveaux tarifs sont particulièrement impressionnants pour les usages répétés. DeepSeek V4-Pro est désormais affiché à 0,435 $ par million de tokens en entrée et 0,87 $ en sortie. MiMo-V2.5-Pro adopte un niveau comparable, avec des cache hits à seulement 0,0036 $ par million de tokens. À ce niveau, l’IA devient beaucoup plus accessible pour des produits qui traitent de grands volumes de texte.

  • 82 milliards de tokens peuvent être obtenus avec certains abonnements haut de gamme chez Xiaomi.
  • Ce volume représente plus de 60 milliards de mots.
  • Les usages les plus favorables sont les agents IA, les outils de recherche documentaire et les systèmes à prompts stables.

Les laboratoires américains suivent une trajectoire différente

Alors que les acteurs chinois baissent leurs prix, certains modèles américains avancent dans l’autre direction. GPT-5.5 a doublé le coût de sortie à 30 $ par million de tokens, tandis que Claude Opus 4.7 s’affiche à 5 $ pour l’entrée et 25 $ pour la sortie. Anthropic a certes maintenu sa grille tarifaire, mais son nouveau tokenizer peut produire jusqu’à 35 % de tokens supplémentaires pour le même texte, ce qui peut alourdir la facture réelle.

  • Gemini 2.5 Pro reste plus modéré côté prix, avec 1,25 $ en entrée et 10 $ en sortie.
  • Les écarts de coût entre modèles peuvent atteindre 15 à 30 fois.
  • Pour des tâches répétitives, la différence de prix devient décisive.

Une guerre de performance, de coût et d’adoption

Le point le plus intéressant n’est pas seulement la baisse tarifaire, mais le fait qu’elle s’accompagne d’une performance élevée. DeepSeek V4-Pro, avec ses 1,6 trillion de paramètres, affiche une qualité proche de Claude Opus 4.6 sur des benchmarks de code, tout en restant bien moins cher. De son côté, MiMo-V2.5 s’inscrit dans la même logique : rendre les modèles de pointe exploitables à grande échelle, sans sacrifier la compétitivité technique.

  • Les benchmarks de type SWE-Verified mesurent des tâches proches du monde réel.
  • Les économies les plus fortes concernent les systèmes qui réutilisent beaucoup de contexte.
  • Pour les éditeurs d’applications IA, le coût du token devient un levier d’adoption massive.

En savoir plus sur L'ABESTIT

Subscribe to get the latest posts sent to your email.

Share post:

Popular

More like this
Related

La guerre en Iran secoue le kérosène des compagnies européennes

Le conflit en Iran rappelle douloureusement la dépendance des transporteurs européens au carburant venu du Moyen-Orient. Le secteur tout entier pourrait être affecté par des changements majeurs....

UE: la mention « généré par IA » devient obligatoire

Une disposition-clé du règlement européen sur l’intelligence artificielle entre en vigueur dimanche 2 août. Les concepteurs et utilisateurs professionnels de systèmes d’IA devront mentionner que leurs contenus ont été créés par cette technologie, sous peine d’amendes....

Saison des feux exceptionnelle, Spokane déclarée en état d’urgence

Aucun des trois incendies qui ont détruit plusieurs quartiers de cette ville de 230 000 habitants, dans l’Etat de Washington, où l’état d’urgence a été déclaré samedi, n’est pour l’instant contenu....

Trump affirme des discussions « en ce moment même » avec l’Iran

Lors d’un échange avec la presse dans le bureau Ovale, le président américain a assuré que ces pourparlers se déroulaient « à la demande » de Téhéran. L’Iran avait déclaré, plus tôt dans la journée, ne pas négocier « avec les Etats-Unis en ce moment »....