H3C : après la course aux GPU, l’heure est à l’optimisation des Tokens
Lors de l’Apsara Conference 2026, le géant chinois des infrastructures IT H3C a présenté sa nouvelle gamme de produits, centrée non plus sur l’accumulation de GPU mais sur l’efficacité de leur utilisation. Alors que le déploiement à grande échelle d’agents d’IA (Agentic AI) génère des besoins en Tokens de l’ordre du billion, H3C estime que l’augmentation brute du nombre de GPU ne suffit plus : les goulets d’étranglement réseau, l’inactivité des puces, les problèmes de refroidissement et les pannes de clusters à grande échelle réduisent les gains de performance. Le constructeur mise sur une optimisation système globale : interconnexions haute vitesse, coordination logiciel-matériel, et gestion unifiée des ressources hétérogènes (CPU, GPU, NPU, DPU). Son nouveau SuperPod UniPoD S80000, scalable jusqu’à 16 384 GPU, illustre cette logique d’intégration plutôt que d’empliement. Concrètement, pour les entreprises et opérateurs cloud asiatiques, cela signifie qu’il faudra repenser leurs investissements infrastructure : le critère pertinent devient le nombre de Tokens utiles par GPU, pas le nombre de GPU déployé. La concurrence se déplace vers les fournisseurs capables d’optimiser le rendement réel des clusters, ce qui pourrait redessiner les parts de marché face à Nvidia ou Huawei.