Meta et Panesia : un datacenter IA fonctionne comme une seule puce grâce au CXL
Meta et la startup coréenne Panesia ont publié le 8 juillet dans la revue Nature Review une architecture de datacenter AI qui utilise l'interface CXL (Compute Express Link) pour relier CPU, accélérateurs et mémoire comme s'il s'agissait d'une seule et même puce. L'objectif est de résoudre le problème de latence explosive lié à la montée en puissance des modèles d'IA dont le nombre de paramètres atteint des billions. Grâce à trois composants matériels supplémentaires — commutateur à forte éventail, contrôleur de fabric et unité d'accélération de liaison — et une version optique du CXL, le nombre d'accélérateurs gérés par un seul CPU passe de 2 à 16, et le domaine de connexion peut atteindre 960. La latence est réduite d'un facteur 10, permettant d'entraîner des modèles encore plus volumineux sans interruption. Pour les opérateurs de datacenters et les chercheurs en IA, cette preuve de concept ouvre la voie à des infrastructures IA plus cohérentes et prévisibles, capables de soutenir la croissance des futurs modèles sans les goulots d'étranglement des réseaux traditionnels (Ethernet, InfiniBand).