Guerre des prix de l'IA : Google divise ses tarifs par deux, DeepSeek quadruple les siens
En trois jours, les deux extrémités du marché ont bougé en sens inverse. Google a sorti Gemini 3.7 Flash à moitié prix, vingt-trois jours après le précédent ; DeepSeek a relevé ses tarifs jusqu'à plus de quatre fois. Pour les entreprises françaises, la note se lit surtout en petits caractères — et le nouvel agent de Google reste hors de portée en Europe.
Gemini 3.7 Flash est arrivé jeudi 13 août, vingt-trois jours après Gemini 3.6 Flash. Ce rythme ne relève plus du calendrier produit mais de la cadence de tir, et il dit quelque chose de la position de Google : la gamme Flash regroupe les modèles rapides et bon marché, taillés pour le gros volume et les agents automatisés. Ce qui manque toujours à l'appel, en revanche, c'est le modèle de pointe. Gemini 3.5 Pro, promis à la conférence développeurs de mai et testé chez des partenaires en juillet, reste invisible.
Beaucoup de Flash, toujours pas de Pro
Sur le papier, la nouvelle version progresse nettement en programmation : Google revendique un bond de 49 % à 65,3 % sur le test DeepSWE, de 34,4 % à 43,6 % sur un autre exercice de code, et un score d'automatisation de tâches presque doublé. Ces mesures sont maison et n'ont pas fait l'objet d'une validation indépendante publiée : elles méritent le conditionnel. Le contexte interne n'incite pas non plus à l'optimisme. La division DeepMind a connu un remaniement complet la semaine précédente, son responsable historique s'effaçant au profit de son adjoint pendant que deux responsables techniques à l'origine de Gemini quittaient l'entreprise pour fonder la leur.
La vraie annonce était dans la grille tarifaire
Gemini 3.7 Flash est facturé 0,75 dollar le million d'unités de texte en entrée et 3,75 dollars en sortie, soit la moitié du tarif de lancement du modèle précédent. Il s'agit d'une promotion valable jusqu'à la fin de l'année, avant un retour au tarif plein. Le choix stratégique est lisible : plutôt que de courir après le meilleur modèle du monde, vendre du calcul en masse au prix le plus agressif possible.
Sauf que ce terrain est déjà occupé. DeepSeek facturait jusqu'ici sa version rapide autour de 0,14 dollar le million d'unités en entrée, cinq fois moins que Google, et diffuse ses modèles sous licence libre — n'importe quelle entreprise peut les installer sur ses propres serveurs sans payer personne. Qwen, chez Alibaba, joue la même partition avec une licence permissive et des centaines de variantes téléchargeables. GLM, Kimi et MiniMax complètent une offre chinoise qui a fait de la casse tarifaire une stratégie industrielle.
Le retournement de DeepSeek
C'est précisément là que la semaine devient intéressante. Le 13 août, DeepSeek a annoncé sur son propre site une nouvelle grille, entrée en vigueur le 16. DeepSeek-V4-Flash passe à 1,32 dollar le million de jetons produits en heure de pointe, contre 0,28 dollar auparavant — une multiplication par plus de quatre. Le V4-Pro suit la même logique, à 3,96 dollars contre 0,87. Les heures creuses restent facturées à moitié prix, l'entreprise assumant vouloir lisser la demande par le tarif plutôt que par la file d'attente.
- Gemini 3.7 Flash : 0,75 $ en entrée, 3,75 $ en sortie par million d'unités — promotion jusqu'à fin 2026.
- DeepSeek-V4-Flash : 1,32 $ en sortie aux heures pleines, contre 0,28 $ avant le 16 août.
- DeepSeek-V4-Pro : 3,96 $ en sortie aux heures pleines, contre 0,87 $ auparavant.
- À titre de comparaison, Kimi K3 est facturé 15 $ et Fable 5 environ 50 $ le million de jetons produits.
Même après cette hausse, DeepSeek reste très en dessous de la plupart de ses concurrents : Moonshot facture Kimi K3 quinze dollars le million de jetons produits, et Anthropic une cinquantaine de dollars pour Fable 5, selon les comparaisons reprises par Bloomberg. Le mouvement s'explique moins par les coûts que par le calendrier financier : l'entreprise de Hangzhou lève des fonds et vise une introduction en Bourse dès 2026. Autrement dit, le prix plancher du marché n'était pas un équilibre économique, mais une position de conquête que son auteur commence lui-même à quitter.
Ce que les entreprises françaises en retirent
Deux conséquences pratiques méritent d'être notées de ce côté-ci de l'Atlantique. La première est comptable : les tarifs qui servent aujourd'hui à bâtir un budget d'automatisation sont, des deux côtés, des tarifs politiques — une promotion chez Google, une position de conquête en train d'être abandonnée chez DeepSeek. Un plan de charge calculé sur les prix d'août 2026 doit être recalculé en janvier.
La seconde est géographique. Le nouveau modèle alimente Spark, l'agent personnel de Google censé exécuter des tâches à la place de l'utilisateur, réservé aux abonnés payants et déployé dans plus de 160 pays. L'Espace économique européen, la Suisse et le Royaume-Uni en sont exclus, sans explication officielle — la même mise à l'écart qu'Apple avait réservée à la nouvelle génération de Siri. Les développeurs français peuvent utiliser Gemini 3.7 Flash dans les outils dédiés, mais l'agent grand public qui en tire parti, lui, ne franchit pas la frontière. Pour une entreprise européenne, la question n'est donc pas seulement de savoir quel modèle coûte le moins cher, mais lequel sera effectivement disponible pour ses équipes.
Sources
- Gemini 3.7 Flash : Google délaisse les modèles de pointe pour affronter les IA chinoises sur le prix01net · 15 août 2026
- DeepSeek augmente brutalement le prix de ses modèles V4 : voici pourquoiLeBigData · 14 août 2026
