Alibaba relie Qwen, les puces Zhenwu et les centres de données dans un plan d’IA intégré
Les annonces d’Alibaba à Apsara dessinent une stratégie d’IA verticalement intégrée, mais les éléments restent mêlés entre déclarations, feuilles de route et réaction du marché.

Alibaba a profité de sa conférence Apsara, organisée à Hangzhou le 22 septembre, pour présenter une version plus intégrée de sa stratégie en intelligence artificielle, en reliant modèles, puces et infrastructure cloud dans un même plan. L’élément central était l’accélérateur Zhenwu V900, annoncé comme l’étape suivante après le M890 et décrit par l’entreprise comme offrant trois fois les performances de cette puce précédente. Alibaba a également fixé un objectif de centres de données pouvant atteindre 20 GW de capacité mondiale d’ici 2032 et décrit un cluster unique capable d’utiliser 500 000 accélérateurs. L’annonce a été bien accueillie par les investisseurs, avec une hausse d’environ 3 % de l’action Alibaba à Hong Kong après ces informations.
Le changement important ne tient pas à un produit pris isolément, mais à la manière dont Alibaba présente l’ensemble de la pile. Le directeur général Eddie Wu a décrit les modèles, les puces et le cloud comme les trois piliers de la stratégie. Ce cadrage compte, car il déplace le récit de l’IA de l’entreprise au-delà d’une approche plus étroite centrée sur les services cloud ou les sorties de modèles, vers une intégration verticale. Alibaba affirme vouloir contrôler une plus grande partie du chemin allant du développement de grands modèles à la conception d’accélérateurs, puis à l’infrastructure utilisée pour entraîner et exécuter ces systèmes. Il s’agit d’une annonce d’intention stratégique, non d’une preuve que chaque couche fonctionne déjà à l’échelle décrite.
Des actifs d’IA séparés à une pile intégrée
La couche des modèles est représentée par Qwen. Alibaba indique entraîner Qwen 4 et affirme que de futurs systèmes Qwen pourraient atteindre entre cinq et dix mille milliards de paramètres. Ces chiffres donnent une idée de l’échelle des systèmes que l’entreprise veut prendre en charge, mais ils n’établissent pas, à eux seuls, une capacité, un coût, une efficacité ou une qualité. Le nombre de paramètres décrit la taille d’un modèle, pas le fait qu’un modèle fonctionne mieux dans des charges de travail réelles. La formulation compte aussi : Qwen 4 est en cours d’entraînement, tandis que les systèmes de cinq à dix mille milliards de paramètres sont présentés comme des possibilités futures. Cela place une partie de la feuille de route des modèles dans la catégorie du plan d’entreprise plutôt que dans celle du produit disponible.
La couche des puces est celle dans laquelle s’inscrit l’annonce de Zhenwu. Alibaba a annoncé l’accélérateur Zhenwu V900 et indiqué viser une disponibilité commerciale de masse au premier trimestre 2027. L’affirmation de performance de l’entreprise est précise : le V900 offre trois fois les performances de l’ancien M890. Il s’agit d’un benchmark d’Alibaba, et non d’une mesure indépendante. Le document ne précise pas la charge de travail, la précision, l’enveloppe énergétique, la pile logicielle ni les conditions de comparaison à l’origine de ce chiffre. Sans ces détails, l’affirmation sert d’indicateur de l’amélioration générationnelle visée par Alibaba, mais ne suffit pas à comparer le V900 à d’autres accélérateurs ni à évaluer le coût total d’exploitation.
Le M890 est plus concret, car Alibaba affirme qu’il est déjà utilisé par plus de 650 clients. Cela reste un chiffre d’adoption fourni par l’entreprise, et non un audit indépendant de l’échelle de déploiement ou de l’intensité d’usage. Il montre toutefois comment Alibaba tente d’établir une continuité entre un produit existant et un futur produit. Le M890 fournit le point de référence installé ; le V900 est positionné comme la génération suivante d’accélérateurs ; et l’expansion prévue des centres de données fournit le contexte d’infrastructure. L’entreprise présente donc une progression interne allant du matériel déjà déployé à du matériel plus performant, puis à des clusters d’IA plus grands.
Ce que montrent les chiffres, et ce qu’ils laissent ouvert
Les chiffres d’infrastructure sont les plus élevés de l’annonce. Le plan d’Alibaba vise 20 GW de capacité mondiale de centres de données d’ici 2032, et l’entreprise a décrit un cluster unique capable d’utiliser 500 000 accélérateurs. Ces données expriment une ambition au niveau de l’infrastructure physique : énergie, sites, équipements et opérations. Elles s’alignent aussi avec les besoins suggérés par l’entraînement et l’inférence de très grands modèles. Mais il s’agit d’objectifs et de descriptions de conception, non d’éléments prouvant qu’une telle capacité est déjà construite, affectée à des charges de travail d’IA ou économiquement alignée avec la demande des clients.
Le chiffre du cluster à 500 000 accélérateurs doit surtout être lu comme un objectif architectural. Il suggère qu’Alibaba réfléchit à des systèmes dans lesquels les couches modèle, accélérateur et cloud sont planifiées ensemble. Un cluster de cette taille exigerait que la couche matérielle et la couche cloud fonctionnent comme un seul système opérationnel. Le document ne fournit pas de résultats de performance pour un tel cluster, et n’indique pas non plus qu’il est déjà en service. Par conséquent, ce nombre démontre l’échelle de la feuille de route d’Alibaba, tout en laissant ouvertes les questions d’ingénierie, de calendrier et d’utilisation qui déterminent si la conception devient une capacité exploitable.
Le supernœud Zhenwu M890 apporte un autre indice sur la manière dont Alibaba prévoit que la pile fonctionne en pratique. Il est conçu pour l’inférence sur des modèles de plus de deux mille milliards de paramètres. L’inférence est l’étape au cours de laquelle les modèles sont utilisés après l’entraînement, et les très grands modèles peuvent imposer de fortes contraintes sur la mémoire, l’interconnexion et la coordination des accélérateurs. Le supernœud M890 s’inscrit donc dans la feuille de route des modèles de l’entreprise : si les futurs systèmes Qwen évoluent vers des tailles de plusieurs milliers de milliards de paramètres, Alibaba veut des configurations matérielles destinées à les servir. La relation de conception est cohérente, mais le document ne donne aucune mesure indépendante de débit, de latence ou d’efficacité.
La réaction du marché fournit un autre type de signal. L’action Alibaba a progressé d’environ 3 % à Hong Kong après les annonces. Cela montre que les investisseurs ont réagi favorablement dans l’immédiat. Cela ne valide pas les affirmations techniques, les chiffres d’adoption ni les objectifs de capacité. Un mouvement de cours peut refléter des attentes, un positionnement et un sentiment autant que des progrès opérationnels. Dans ce cas, la hausse doit surtout être traitée comme la preuve que le marché a remarqué le message de pile complète, et non comme la preuve que le V900, Qwen 4 ou le plan de 20 GW atteindront leurs objectifs.
Les implications pratiques pour Alibaba Cloud
Pour les clients et les développeurs, l’implication pratique est qu’Alibaba veut rendre son cloud d’IA plus verticalement contrôlé. Si les modèles, les puces et l’infrastructure cloud sont conçus ensemble, l’entreprise pourrait être en mesure d’adapter les configurations matérielles à sa propre feuille de route de modèles et à ses services cloud. Le supernœud M890 pour des modèles de plus de deux mille milliards de paramètres illustre cette logique. Au lieu de traiter les accélérateurs comme des composants génériques, Alibaba les présente comme une partie d’un système construit autour de grands modèles de classe Qwen et de l’infrastructure cloud nécessaire à leur exécution.
Cette approche pourrait réduire certains problèmes de coordination au sein du propre écosystème d’Alibaba, mais elle soulève aussi des questions d’exécution. La disponibilité commerciale de masse du Zhenwu V900 est visée pour le premier trimestre 2027, ce qui signifie que la principale nouvelle puce reste inscrite dans un calendrier futur. Qwen 4 est encore en cours d’entraînement, et les plus grands nombres de paramètres Qwen sont décrits comme des systèmes futurs. L’objectif de capacité de 20 GW court jusqu’en 2032. La stratégie couvre donc plusieurs horizons à la fois : l’usage actuel du M890 par des clients, l’entraînement de modèles à court terme, le lancement futur d’un accélérateur et un déploiement d’infrastructure plus long.
Une feuille de route, pas un benchmark indépendant
La lecture la plus nette est qu’Alibaba tente de définir la compétitivité en IA comme un problème de systèmes. Son annonce relie l’échelle des modèles, la conception d’accélérateurs et la capacité des centres de données dans un même plan d’entreprise. C’est le changement significatif : Alibaba ne décrit pas seulement une nouvelle puce ou un nouveau modèle, mais un chemin verticalement intégré pour entraîner et servir de grands systèmes d’IA. Les limites sont tout aussi claires. Le chiffre de performance du V900 à trois fois celle du M890 est une affirmation d’Alibaba, pas un benchmark indépendant. Le nombre de clients du M890 est un chiffre d’adoption d’Alibaba, pas un audit d’usage. Les chiffres de 20 GW et de 500 000 accélérateurs sont des objectifs de capacité et d’architecture, pas des déploiements achevés. Les annonces fixent une direction et une échelle ; elles ne prouvent pas encore des performances livrées sur toute la pile.
Sources
- Alibaba shares jump as new AI chip and data-center plans are unveiledCNBC · 22 septembre 2026
- Alibaba sets out full-stack AI strategy at ApsaraQbitAI · 22 septembre 2026



