Article complet du Daily Podcast
Alibaba prépare une IA à 10 000 milliards de paramètres
Alibaba pose un nouveau jalon dans la course à l’IA de frontière : un modèle annoncé entre 5 000 et 10 000 milliards de paramètres, une nouvelle puce Zhenwu V900 et un objectif de plus de 20 gigawatts de capacité mondiale pour les centres de données d’Alibaba Cloud d’ici 2032.

Une annonce de taille industrielle
Alibaba ne présente pas seulement un modèle plus grand. Le groupe présente une stratégie complète: modèle géant, silicium maison et expansion massive de son infrastructure cloud. Son directeur général, Eddie Wu, a déclaré que l’entreprise prévoyait d’entraîner un nouveau modèle d’intelligence artificielle comptant entre 5 000 et 10 000 milliards de paramètres, tout en dévoilant la puce Zhenwu V900 et en fixant un objectif de plus de 20 gigawatts de capacité mondiale pour les centres de données d’Alibaba Cloud d’ici 2032 .
Le chiffre est spectaculaire, mais il n’est pas isolé. Un modèle de 10 000 milliards de paramètres se situerait à une échelle très supérieure à celle que la plupart des modèles commerciaux détaillent publiquement aujourd’hui, et Alibaba l’inscrit directement dans un plan d’infrastructure . C’est un point essentiel: le nombre de paramètres ne suffit pas à mesurer l’intelligence d’un système. La qualité des données, l’architecture, les méthodes d’entraînement, l’efficacité à l’inférence, l’usage d’outils, l’alignement et les garde-fous pèsent tout autant dans la performance réelle.
L’échelle reste toutefois un signal fort. Entraîner un modèle de 5 000 à 10 000 milliards de paramètres exige une densité de calcul extrême, des réseaux rapides, une mémoire abondante, une alimentation électrique robuste et des systèmes de refroidissement capables de suivre. Le message d’Alibaba est clair: l’entreprise ne veut pas dépendre uniquement de ressources externes pour participer à cette phase de la course à l’IA. Elle veut faire progresser ensemble le modèle, la puce et le cloud.
Zhenwu V900, la puce au cœur du pari
La Zhenwu V900 est l’autre pièce maîtresse de l’annonce. Reuters rapporte qu’Alibaba la présente comme la puce d’IA la plus puissante de Chine, avec des performances trois fois supérieures à celles de son prédécesseur . Des médias chinois spécialisés dans les semi-conducteurs indiquent également que T-Head, la division puces d’Alibaba, a lancé la Zhenwu V900 et que sa puissance de calcul atteint trois fois celle de la Zhenwu M890 .
Le rapport de Bloomberg, repris par Free Malaysia Today, ajoute un détail crucial: l’accélérateur V900 pourrait être combiné en grappes allant jusqu’à 500 000 unités pour l’entraînement de modèles de frontière . Si Alibaba parvient à concrétiser une telle architecture en production, il ne s’agit pas seulement d’une nouvelle puce. Il s’agit d’un défi d’ingénierie système. L’entraînement des plus grands modèles est limité non seulement par la puissance de calcul brute, mais aussi par la capacité de centaines de milliers de puces à communiquer efficacement, à tolérer les pannes, à recevoir les données nécessaires et à rester alimentées en continu.
C’est là que l’objectif de 20GW prend tout son sens. PANews rapporte qu’Eddie Wu a expliqué, lors de la conférence Apsara, que la demande des clients en IA est très forte et qu’Alibaba investira pleinement dans l’infrastructure nécessaire, avec pour cible plus de 20GW de capacité mondiale exploitée par Alibaba Cloud d’ici 2032 . Une telle empreinte énergétique correspond à une vision de long terme: non seulement entraîner de grands modèles, mais aussi les servir à grande échelle à des entreprises, développeurs et applications grand public.
Pourquoi logiciel et matériel sont indissociables
L’annonce d’Alibaba serait moins convaincante si elle se limitait à un objectif de paramètres. Le plus difficile dans l’IA de frontière n’est pas d’annoncer un grand modèle; c’est de réunir le capital, l’énergie, les puces, les réseaux et l’expertise opérationnelle nécessaires pour l’entraîner et l’exploiter. En associant son projet de modèle de 5 000 à 10 000 milliards de paramètres à la Zhenwu V900 et à un objectif de centres de données pour 2032, Alibaba affirme que la course à l’IA est aussi une course aux infrastructures .
Cette orientation répond également à la dynamique du marché des accélérateurs. Bloomberg décrit la V900 comme une puce destinée à rivaliser avec Nvidia et à soutenir l’expansion des centres de données d’Alibaba . Pour les acteurs chinois du cloud et de l’IA, le silicium domestique n’est pas seulement un outil de réduction des coûts. C’est aussi un moyen de limiter l’exposition aux contraintes d’approvisionnement, aux contrôles à l’exportation et aux incertitudes entourant l’accès aux accélérateurs étrangers.
Cette intégration renforce aussi l’offre cloud d’Alibaba. Si le groupe peut proposer à ses clients des modèles de fondation, des services d’IA, des puces propriétaires et une capacité cloud dense, il peut vendre une plateforme plus cohérente et plus difficile à répliquer. PANews rapporte en outre que les livraisons annuelles de puces d’IA de T-Head devraient augmenter nettement . Cela suggère qu’Alibaba ne prépare pas seulement une démonstration technologique, mais un déploiement commercial plus large.
Le piège du nombre de paramètres
Le chiffre de 10 000 milliards attirera naturellement l’attention, mais il ne doit pas être confondu avec une garantie de supériorité. Le nombre de paramètres indique la quantité de poids appris dans un modèle; il ne mesure pas directement la qualité du raisonnement, la fiabilité, la compréhension multimodale, la précision factuelle ou la capacité à accomplir des tâches utiles.
Cette nuance est d’autant plus importante que l’industrie évolue vers des architectures plus complexes. Les modèles à mélange d’experts, l’activation parcimonieuse, la recherche d’information, l’usage d’outils, les agents et les longues fenêtres de contexte peuvent modifier le lien entre taille totale et performance pratique. Un modèle de 10 000 milliards de paramètres peut ne pas activer tous ses paramètres à chaque requête, et son coût réel dépendra fortement de son architecture et de son efficacité à l’inférence.
Il faut donc lire l’annonce comme un signal de capacité. Alibaba indique à ses clients, concurrents et investisseurs qu’il veut construire à une échelle comparable à celle des plus grands acteurs mondiaux de l’IA. Le groupe signale aussi qu’il anticipe une demande suffisamment forte pour justifier des investissements lourds et durables.
Argent, énergie et risque d’exécution
Le projet est coûteux par nature. Bloomberg rapporte qu’Alibaba s’est engagé à investir plus de 53 milliards de dollars sur trois ans pour développer ses capacités en IA et qu’il a levé environ 10,2 milliards de dollars lors d’une émission d’actions à Hong Kong en août . Ces montants replacent l’annonce dans sa réalité financière: un programme d’IA de frontière n’est pas seulement un projet logiciel, mais un cycle d’investissement industriel.
Le risque d’exécution est considérable. Construire une telle capacité de centres de données ne consiste pas simplement à acheter des serveurs. Alibaba devra sécuriser l’accès à l’électricité, le refroidissement, les connexions au réseau, les chaînes d’approvisionnement, les rendements de fabrication des puces, les logiciels de gestion de clusters et une base de clients prête à payer pour ces services. Une grappe de 500 000 puces paraît impressionnante, mais la fiabilité à cette échelle est difficile à maintenir. Même des taux de panne modestes deviennent importants lorsque le système comporte des centaines de milliers de composants.
Le risque de marché existe aussi. Si la demande en IA ralentit, ou si des percées d’efficacité réduisent le besoin de très grands clusters, l’économie d’un déploiement à 20GW pourrait évoluer. À l’inverse, si les agents, les assistants de programmation, l’automatisation des entreprises et les systèmes multimodaux continuent de se diffuser, l’approche intégrée d’Alibaba pourrait devenir un avantage majeur.
Une candidature chinoise au club des hyperscalers de l’IA
Alibaba cherche à se positionner parmi les rares entreprises capables de couvrir toute la chaîne de valeur de l’IA: modèles de fondation, puces, cloud et services commerciaux. Les annonces de la conférence Apsara rendent cette ambition explicite. Le groupe ne dit pas seulement qu’il veut un modèle plus grand; il dit qu’il veut la base de calcul nécessaire pour l’entraîner et l’exploiter.
L’objectif de 5 000 à 10 000 milliards de paramètres est la partie spectaculaire. La Zhenwu V900 et la cible de plus de 20GW de capacité cloud sont la partie opérationnelle. Ensemble, elles montrent que l’IA de frontière ressemble de moins en moins à une simple compétition de modèles et de plus en plus à une compétition de capacité industrielle. Le sortilège cloud d’Alibaba a désormais un chiffre, un nom de puce et un objectif énergétique.
Sources des dernières 72 heures
- [1]Alibaba plans AI model with 5 trillion to 10 trillion parameters, unveils new chip22 sept. 2026, 02:52 UTC
- [2]Alibaba unveils AI chip to drive 20GW of data centres by 203222 sept. 2026, 02:58 UTC
- [3]Alibaba: Will Fully Invest in AI Infrastructure Construction, Alibaba Cloud Data Center Scale to Exceed 20GW by 203222 sept. 2026, 00:00 UTC
- [4]阿里巴巴:将全力投入AI基础设施建设 2032年阿里云数据中心规模将超20GW22 sept. 2026, 02:29 UTC
Article généré par IA à partir d’une recherche web récente, puis conservé comme instantané éditorial daté.

Commentaires
Sois le premier à commenter.