Alibaba propose la location à l'heure de contrats d'IA de pointe : exclusivement pour une province chinoise isolée
Alibaba propose des capacités de calcul IA à grande échelle grâce à la location horaire de supercalculateurs, les restrictions géographiques étant limitées à une province chinoise isolée.
Les choses les plus importantes que vous devez savoir
- Alibaba propose un supercalculateur d'IA local, construit sur des puces chinoises et un cloud local, afin de contourner les limitations d'accès aux puces Nvidia et AMD les plus récentes et d'offrir une faible latence aux entreprises chinoises.
- Le supernœud d'Alibaba est basé sur le processeur Zhenwu M890, qui dispose de 144 Go de mémoire HBM et d'une bande passante inter-puces allant jusqu'à 800 Go/s, et exécute actuellement des services commerciaux pour de grands modèles de langage dépassant 2 billions de paramètres.
- Alibaba prévoit de développer des processeurs ultra-fins plus puissants, avec l'arrivée du Zhenwu V900 au troisième trimestre 2027 offrant des performances trois fois supérieures à celles du M890, suivi du Zhenwu J900 au troisième trimestre 2028.
Alibaba Cloud a lancé la commercialisation du supernœud Lingjun Zhenwu M890, permettant aux clients de louer une unité de calcul connectée à haut débit de 64 cartes sans avoir à construire leur propre centre de données.

Ce lancement en fait le seul supernœud d'origine chinoise que les utilisateurs peuvent utiliser efficacement en ligne sans avoir besoin d'un contrat d'achat ni d'un modèle d'IA préconfiguré , ce qui représente un atout majeur pour les entreprises.
Mais attention aux passionnés qui souhaiteraient l'essayer en dehors de la Chine : pour l'instant, son utilisation est limitée aux utilisateurs de la région autonome de Mongolie-Intérieure, dans le nord de la Chine.
Qu’est-ce qu’Alibaba propose aux consommateurs de la part des entreprises ?
Un supernœud est un groupe d'accélérateurs si étroitement interconnectés que le logiciel les traite comme une seule et même puce de très grande taille, plutôt que comme un réseau de puces distinctes. Cette approche est souvent indispensable ; un modèle trop volumineux pour tenir sur une seule carte devra transmettre ses données via un réseau relativement plus lent, et ces coûts supplémentaires peuvent déterminer la viabilité d'un service composé de mille milliards de puces.
Un exemple parfait est le GB200 NVL72 de Nvidia, qui utilise 72 de ses GPU Blackwell dans une seule configuration, ou la configuration Helios à 72 GPU d'AMD, qui offre ses GPU Instinct MI455X avec plus de mémoire par GPU.
L'offre d'Alibaba n'est pas plus rapide que les deux exemples mentionnés, qui figurent parmi les options les plus rapides disponibles pour les consommateurs du monde entier, mais elle offre une combinaison d'avantages aux consommateurs chinois locaux qui ne seraient pas disponibles autrement : des puces en silicium chinoises, un cloud chinois et des temps de réponse plus courts.
Un super-nœud localisé, construit sur une combinaison de restrictions et de sanctions gouvernementales.
Face aux restrictions imposées par Pékin aux fournisseurs de cloud chinois concernant l'accès aux puces Nvidia et AMD de dernière génération – une mesure perçue comme une riposte aux politiques de plus en plus strictes de la Maison Blanche –, les entreprises et les startups spécialisées en IA privilégient de plus en plus les solutions locales. L'utilisation de puces fabriquées localement par Alibaba Cloud illustre parfaitement l'impact de cette politique sur son offre, soulignant la menace que représente la dépendance croissante aux fournisseurs d'IA pour la résilience des systèmes.
Le processeur Zhenwu M890 a été présenté pour la première fois lors du sommet Alibaba Cloud en mai 2026, où la société a également dévoilé une feuille de route détaillée pour ses chipsets jusqu'en 2028. Ce processeur, développé par T-Head, l'unité de conception de chipsets du groupe, intègre 144 Go de mémoire HBM avec une bande passante inter-puces pouvant atteindre 800 Go/s. Son architecture d'interconnexion utilise une puce ICNSwitch 1.0 interne, augmentant ainsi la capacité d'extension de 16 cartes (Zhenwu 810E de la génération précédente) à 64 et la bande passante de 700 Go/s.
L'entreprise affirme que cette configuration est, en théorie, capable de gérer une configuration AI Mixture of Experts (MoE) allant jusqu'à 10 billions de paramètres, soulignant qu'il s'agit de la première architecture de supernœud en Chine à exécuter avec succès de grands modèles de langage dépassant 2 billions de paramètres ; Alibaba note que la version actuelle exécute déjà des services commerciaux pour Kimi K3 et Qwen3.8-Max.
Alibaba poursuit son développement après le M890. T-Head a annoncé que le processeur Zhenwu V900 sera disponible au troisième trimestre 2027. Offrant des performances trois fois supérieures à celles du M890, il sera doté de 216 Go de mémoire et d'une bande passante inter-puces de 1 200 Go/s. Le Zhenwu J900 suivra au troisième trimestre 2028.
Aucun prix n'est disponible publiquement pour ce supernœud, et aucune information n'est disponible concernant sa consommation énergétique ; les comparaisons avec les solutions courantes sont, au mieux, rares. Malgré le manque d'informations et les contraintes géographiques, cette initiative souligne l'autonomie croissante de la Chine dans le domaine de l'IA et ses ambitions, qui pourraient permettre à un plus large éventail de consommateurs, tant nationaux qu'internationaux, d'accéder à ce supernœud dans un avenir proche.
Les commentaires sont fermés.