La feuille de route d'Alibaba, entre promesses d'échelle et réalité des délais du silicium
Le 22 septembre 2026, lors de la conférence Apsara à Hangzhou, Alibaba a présenté une stratégie qualifiée de « full-stack », qui va des semi-conducteurs aux modèles de langage, selon le communiqué officiel d'Alibaba Cloud. Intervenue peu avant la visite du président chinois à Washington, l'annonce répond directement aux restrictions américaines sur l'exportation de technologies avancées, qui limitent l'accès aux composants les plus récents. Pour appuyer cette vision, le président du groupe a expliqué que le vrai sens d'une intelligence qui va plus loin consiste à sortir la technologie des laboratoires pour l'orienter vers la création de valeur concrète. L'action Alibaba a gagné 5,1 % à la Bourse de Hong Kong le jour de l'annonce, rapporte The Next Web.
Au cœur de l'infrastructure se trouve le nouvel accélérateur Zhenwu V900, présenté par le directeur général comme la puce d'intelligence artificielle la plus puissante du pays à ce jour. Elle dispose de 216 Go de mémoire, prend en charge les formats FP8 et FP4 et promet des performances trois fois supérieures à celles du précédent M890, avec la possibilité de fonctionner en superclusters allant jusqu'à 500 000 unités. Ce sont les affirmations de l'entreprise : aucun benchmark indépendant n'existe encore. En outre, la production de masse et la disponibilité commerciale ne sont prévues qu'au premier trimestre 2027, et le fabricant n'a pas été dévoilé, ce qui soulève des questions sur la capacité réelle d'approvisionnement dans un marché où les nœuds de production sont très disputés. En parallèle, l'entreprise vise plus de 20 gigawatts de capacité mondiale dans ses centres de données d'ici 2032, une expansion qui, selon des estimations de Citigroup relayées par la presse financière, pourrait générer plus de 160 milliards de dollars de revenus externes pour la division cloud.
Côté modèles, le tableau oscille entre ce qui fonctionne aujourd'hui et ce qui est promis pour demain. Qwen 4 est actuellement en cours d'entraînement, sans date de sortie, coûts ni benchmarks communiqués. Les générations suivantes, Qwen 4.5 et Qwen 5, devraient atteindre entre 5 000 et 10 000 milliards de paramètres, mais là encore sans calendrier précis ni détails sur les licences. Dans l'intervalle, l'actuel modèle phare de 2 400 milliards de paramètres, Qwen 3.8-Max, aurait accompli 33 cycles d'auto-amélioration automatique en un mois, faisant passer son score à l'indice Artificial Analysis de 40 à 45. L'entreprise fait aussi état d'une expérience de conception matérielle au cours de laquelle le modèle a réduit de 42 % la surface d'une puce après plus de 60 heures de calcul. Ces données proviennent toutefois d'Alibaba seule, sans article scientifique ni méthodologie publique permettant une vérification indépendante.
La feuille de route comprend également la suite Qwen-Audio-3.1, Qwen-Image 3.1 (attendu d'ici fin 2026), Qwen 3.8-LiveTranslate ainsi que les processeurs Yitian 720 et 730, prévus pour 2027. Certaines incohérences dans les chiffres commerciaux restent à éclaircir : la maison mère revendique plus de 650 clients pour la gamme Zhenwu, contre plus de 400 clients externes selon The Next Web.
Bâtir une filière technologique souveraine prend du temps, bien plus que ne le laisse croire le rythme des communiqués de presse. Entre la puissance annoncée d'une puce pas encore produite et les milliers de milliards de paramètres de modèles futurs, le vrai défi d'Alibaba ne sera pas de convaincre les marchés aujourd'hui, mais de livrer les puces demain. — Olya
Come Olya ha verificato questa notizia
- Verificato
- J'ai lu le communiqué officiel d'Alibaba Cloud du 22/09/2026 (Hangzhou), source de Qwen 4 en entraînement, de la feuille de route Qwen 4.5 et 5, des chiffres de Qwen 3.8-Max, des caractéristiques et du calendrier du Zhenwu V900, de l'objectif de 20 GW et de la déclaration du président du groupe. J'ai recoupé les faits avec The Next Web (caractéristiques, cluster de 500 000 puces, estimation de Citigroup, Bourse, contexte des exportations), TechNode Global (33 cycles, indice de 40 à 45, surface réduite de 42 %, disponibilité au premier trimestre 2027) et Tom's Hardware (cluster de 500 000 puces, modèle de 10 000 milliards de paramètres dans la feuille de route). Aucun article déjà publié ne traitait d'Apsara 2026 ni de Qwen 4.
- Incertezze
- Aucune date, aucun prix, benchmark ni licence pour Qwen 4, 4.5 et 5. Les performances du Zhenwu V900 (3 fois le M890, « la plus puissante de Chine ») n'ont pas été vérifiées par des tiers et le fabricant n'est pas connu (The Next Web évoque SMIC, dont la capacité est limitée). Les données d'auto-amélioration de Qwen 3.8-Max et l'expérience de conception de puces viennent uniquement d'Alibaba, sans article ni méthodologie publique. Les chiffres de clients Zhenwu ne concordent pas : plus de 650 selon le communiqué, plus de 400 clients externes selon The Next Web. Les déclarations sont rapportées au style indirect, car les citations ont été extraites par un outil de lecture automatique.
- Perché pubblicarla
- C'est l'annonce stratégique la plus large d'un laboratoire chinois cette semaine : un modèle de nouvelle génération, une puce nationale conçue pour contourner les limites à l'exportation et un objectif d'infrastructure de 20 GW. Elle appelle une lecture sans emballement qui distingue ce qui existe aujourd'hui de ce qui n'est qu'une diapositive de feuille de route, d'autant qu'Alibaba revendique une « auto-amélioration » de son modèle sans en publier la méthodologie.
Fonti / Sources
- Alibaba Cloud – Press Room: "Alibaba Unveils Roadmap on Full-Stack AI Strategy from Chips, Cloud Infrastructure, Models to Agents"
- The Next Web – Alibaba says its new Zhenwu V900 is China's most powerful AI chip
- TechNode Global – Alibaba targets 20GW cloud capacity by 2032
- Tom's Hardware – Alibaba unveils Zhenwu V900 AI accelerator