
L’IA agentique se joue de plus en plus en local, et MSI veut occuper le terrain du poste de travail jusqu’au nœud compact en continu. Le constructeur ajoute désormais NVIDIA Nemotron 3.5 Lightning et NeMo Switchyard à ses plateformes XpertStation WS300 et EdgeXpert, avec une promesse claire : garder le routage et l’exécution des modèles au plus près de la machine.
NVIDIA Nemotron 3.5 Lightning au cœur de la stratégie MSI
Le support annoncé concerne à la fois NVIDIA Nemotron 3.5 Lightning, un modèle ouvert léger pensé pour l’agentic AI, et NVIDIA NeMo Switchyard, une bibliothèque open source de routage de modèles. L’idée est de confier chaque étape d’un workflow au modèle le plus adapté, qu’il s’agisse d’un grand modèle pour le raisonnement complexe ou d’un modèle plus léger pour des tâches spécialisées à fort volume.
MSI positionne ainsi le XpertStation WS300 comme un supercalculateur IA de bureau pour le développement local, le fine-tuning et les workflows agentiques multimodèles. De son côté, EdgeXpert reprend cette logique dans un format compact destiné à des agents IA fonctionnant en permanence.
Deux plateformes, deux échelles de déploiement
WS300 vise le multimodèle dans un seul nœud
Le MSI XpertStation WS300 repose sur le NVIDIA GB300 Grace Blackwell Ultra Desktop Superchip et peut embarquer jusqu’à 748 Go de mémoire cohérente. Cette capacité permet d’exécuter localement Switchyard en parallèle de plusieurs modèles, y compris des modèles de grande taille et Nemotron 3.5 Lightning, sans déporter certaines étapes vers une infrastructure externe.
Deux unités WS300 peuvent en outre être reliées directement via une NVIDIA ConnectX-8 SuperNIC pour des charges plus lourdes. MSI mentionne aussi du stockage NVMe PCIe Gen 5/Gen 6, afin d’alimenter correctement les pipelines de données lors de charges soutenues en multimodèle.
EdgeXpert étend le routage sur plusieurs nœuds
Le MSI EdgeXpert, basé sur la plateforme NVIDIA DGX Spark, utilise le NVIDIA GB10 Grace Blackwell Superchip. MSI annonce jusqu’à 1 petaFLOP de calcul IA et 128 Go de mémoire unifiée cohérente dans un format compact.
D’après le constructeur, cette enveloppe suffit à maintenir sur l’appareil Nemotron 3.5 Lightning ainsi que des modèles allant jusqu’à 200 milliards de paramètres, afin de conserver localement les tâches agentiques spécialisées à gros volume. La connectivité NVIDIA ConnectX-7 permet de regrouper jusqu’à quatre EdgeXpert et d’étendre le routage Switchyard à un plus grand pool de modèles locaux.
Ce que NeMo Switchyard change dans l’usage
NeMo Switchyard se présente comme une bibliothèque open source de routage pour agents IA. Elle évalue chaque étape d’un workflow, choisit automatiquement le modèle disponible le plus pertinent, et le fait sans entraînement préalable ni configuration manuelle, tout en affinant ses décisions à mesure que les agents tournent.
Nemotron 3.5 Lightning, de son côté, est dérivé du modèle frontier Nemotron 3 Ultra de NVIDIA. Son architecture hybride mixture-of-experts repose sur 30 milliards de paramètres au total, dont 3 milliards de paramètres actifs, avec une fenêtre de contexte allant jusqu’à 1 million de tokens. Sur le papier, c’est exactement le type de modèle conçu pour tourner en continu à côté de modèles plus lourds, dans une logique de spécialisation et de réduction des coûts de traitement.
Cette annonce dit surtout une chose : MSI essaie de se placer non seulement sur le matériel IA, mais aussi sur la continuité d’usage entre station de travail locale et déploiement en périphérie. Avec des machines capables d’absorber du routage multimodèle sans repasser systématiquement par le cloud, le sujet ne se limite plus à la puissance brute, mais à la façon dont les modèles sont orchestrés sur site.
Source : TechPowerUp