
Une annonce perdue sur Avito cachait une machine dotée d’une quantité de mémoire vidéo rarement accessible à ce tarif. Son acheteur l’a négociée à 3 000 roubles, soit 35 dollars, environ 30 euros, puis reconvertie pour l’IA locale.
Un rig de minage doté de neuf GPU P106
Repérée par l’utilisateur Reddit « u/markpronkin » sur Avito, plateforme russe comparable à eBay ou Craigslist, la configuration réunissait neuf GPU P106 équipés chacun de 6 Go de VRAM. Ces cartes destinées au minage dérivent largement de la GeForce GTX 1060 et cumulent ici 54 Go de mémoire vidéo.
Le vendeur en demandait initialement 5 000 roubles, soit 60 dollars, environ 52 euros. Après négociation, le lot est parti pour 3 000 roubles. La fin de la fièvre du minage transforme ainsi certains anciens rigs en plateformes d’expérimentation particulièrement bon marché.
54 Go de VRAM, mais une architecture Pascal très contrainte
La capacité mémoire permet d’envisager des modèles plus lourds, mais elle ne détermine pas seule les performances de prefill et de génération. La bande passante, la puissance de calcul et les échanges entre cartes restent déterminants. Or, ces GPU Pascal lancés en 2016 sont désormais lents, tandis que les rigs de minage reposent généralement sur des liaisons PCIe x1, très pénalisantes pour les transferts inter-GPU.
La machine peut néanmoins accueillir Qwen3.8-27B avec une quantification 8 bits. Elle peut également charger des modèles atteignant 70 milliards de paramètres en quantification 4 ou 5 bits, au prix de performances éloignées de celles d’une station de travail moderne coûtant plusieurs milliers de dollars.
Plus de 30 tokens par seconde sous Ollama
L’acheteur a testé Qwen3.6 35B-A3B avec Ollama et rapporte un débit supérieur à 30 tokens par seconde. Il estime pouvoir encore progresser avec des optimisations supplémentaires. Dépourvu de SSD, le système a simplement été démarré depuis une clé USB.
Le coût d’exploitation demeure l’angle mort de ce type de récupération, neuf cartes Pascal pouvant rapidement effacer l’économie réalisée à l’achat. Dans ce cas précis, l’utilisateur indique bénéficier gratuitement de l’électricité. Pour un amateur disposant de conditions similaires, ces machines restent une voie atypique mais crédible pour expérimenter des LLM denses sans investir dans des GPU récents.
Source : Reddit