
Le duo CPU/IPU reprend la main dans les data centers d’IA, avec à la clé une promesse claire : performance prévisible et meilleure efficacité à l’échelle.
Google et Intel scellent un partenariat pluriannuel qui aligne plusieurs générations de Xeon et accélère le développement d’IPU ASIC sur mesure pour décharger le CPU des tâches d’infrastructure.
Intel Xeon et IPU au cœur de l’orchestration IA
Google Cloud continue de déployer des processeurs Intel Xeon au sein de ses instances optimisées par charge, dont les dernières C4 et N4 propulsées par des Intel Xeon 6. Ces configurations ciblent l’orchestration d’entraînements à grande échelle, l’inférence à faible latence et le calcul généraliste.

Parallèlement, les deux entreprises étendent leur co‑développement d’IPU basées sur des ASIC programmables. Objectif : offloader réseau, stockage et sécurité depuis l’hôte, augmenter l’utilisation effective des ressources et stabiliser la QoS dans des environnements hyperscale.
Intel met en avant un alignement sur plusieurs générations de Xeon afin d’optimiser performance, efficacité énergétique et TCO sur l’infrastructure mondiale de Google. Le message est net : l’IA ne repose pas uniquement sur des accélérateurs, mais sur des systèmes équilibrés où le CPU reste le pivôt de l’orchestration.
Plateforme conjointe : compute généraliste et accélération d’infrastructure
Les IPU s’imposent comme brique critique des architectures modernes : en reprenant des fonctions historiquement gérées par le CPU, elles libèrent du compute utile et réduisent la variabilité des performances. Le tandem Xeon + IPU constitue une plateforme intégrée pensée pour la scalabilité des services IA dans le cloud.
Lip‑Bu Tan, CEO d’Intel, rappelle que « l’IA redéfinit la construction et la mise à l’échelle de l’infrastructure », tandis qu’Amin Vahdat, SVP & Chief Technologist AI Infrastructure chez Google, souligne la place centrale des CPU et de l’accélération d’infrastructure, de l’orchestration d’entraînement au déploiement.
En combinant compute généraliste et accélérations dédiées, l’accord vise une utilisation accrue, une complexité réduite et une montée en charge plus efficace. Il jette ainsi les bases d’une nouvelle génération de services cloud pilotés par l’IA.
Pour le marché, l’alignement de Google sur Xeon 6 pour C4/N4 et la montée en puissance d’IPU custom confortent une trajectoire où le CPU redevient la pièce maîtresse de l’IA distribuée : coordination, pipeline data, sécurité et prévisibilité, pendant que les accélérateurs restent focalisés sur le calcul massivement parallèle.
Source : TechPowerUp