NVIDIA CMP 170HX 64 Go HBM2e (Modifiée, ex-minage)
Plateforme de niveau entreprise, assemblée et testée dans l'UE.
NVIDIA CMP 170HX 64 Go HBM2e — Mémoire vidéo économique pour l'inférence résidente
Il s'agit d'un CMP 170HX basé sur un chipset GA100, dont la mémoire a été étendue à 64 Go de HBM2e. À 1 600 €, cela représente environ 25 € par gigaoctet de VRAM à large bande passante, soit environ un cinquième du prix des cartes graphiques professionnelles à grande capacité de VRAM. Ce matériel modifié présente des limitations réelles, que nous détaillons ci-dessous avant tout achat.
Ce que cette carte est — et n'est pas
La CMP 170HX était commercialisée par NVIDIA comme une carte dédiée au minage : une GA100 allégée dont l’interface PCIe était volontairement limitée à la norme PCIe 1.0 et la plupart des fonctions d’affichage et de calcul restreintes. Ces unités ont été modifiées ultérieurement pour embarquer 64 Go de mémoire HBM2e. Elles constituent ainsi une solution particulièrement économique pour stocker un modèle volumineux entièrement en mémoire à large bande passante, mais un mauvais choix pour toute application nécessitant des transferts rapides vers l’hôte, le multi-GPU ou l’entraînement de programmes.
Pourquoi l'option ×16 coûte 150 € de plus
Les deux versions sont verrouillées sur la signalisation PCIe 1.0 ; cette configuration est irréversible. La différence réside dans le nombre de voies, ce qui multiplie par 4 la bande passante entre l’hôte et la carte.
| PCIe 1.0 ×4 — 1 750 € | ~1 Go/s · Remplir 64 Go prend environ une minute |
| PCIe 1.0 ×16 — 1 750 € | ~4 Go/s · Remplir 64 Go prend environ 15 secondes |
Données techniques
| GPU | NVIDIA GA100 — Ampère |
| Mémoire | 64 Go HBM2e (modifiée — configuration non standard) |
| calcul | Fusion partielle désactivée par rapport à l'A100 — axée sur la capacité, et non sur le débit |
| Interface | PCIe 1.0 ×4 ou PCIe 1.0 ×16 (à sélectionner ci-dessus) |
| Bande passante de l'hôte | ~1 Go/s (×4) · ~4 Go/s (×16) |
| Affichage des sorties | Aucun — calcul uniquement |
| Refroidissement | Passif — nécessite un flux d'air dans le châssis |
| État | Matériel d'occasion, provenant du secteur minier — testé avant expédition |
Où ça s'intègre
- Un seul modèle volumineux, résidant dans la VRAM, est utilisé : il est chargé une seule fois et fonctionne pendant des heures.
- Expérimenter avec des modèles haut de gamme à petit budget, où l'intérêt principal réside dans le fait de proposer 64 Go pour 1 600 €.
- Les tâches d'inférence par lots qui sont limitées par la VRAM plutôt que par le transfert.
- Apprentissage et développement sur les flux de travail de modèles de grande envergure sans dépenses liées aux GPU de centres de données.
Là où cela ne convient pas
- Entraînement ou réglage fin — PCIe 1.0 et puissance de calcul réduite sont deux obstacles à surmonter.
- Configurations multi-GPU parallèles de tenseurs — l'interconnexion est beaucoup trop lente.
- Charges de travail qui diffusent des données en continu depuis la mémoire ou le disque de l'hôte.
- Tout appareil nécessitant un affichage, ou une carte graphique sur laquelle vous pouvez compter pendant des années en production.
QFP
Mon système d'exploitation reconnaîtra-t-il la totalité des 64 Go ?
Nos tests ont démontré que la totalité de la capacité est adressable, ce qui justifie pleinement l'achat de cette carte. La capacité de calcul, quant à elle, est partiellement limitée par rapport à une véritable A100, et varie d'une carte à l'autre. Veuillez nous indiquer votre charge de travail prévue avant de commander ; nous vous indiquerons clairement si cet achat est judicieux.
Puis-je obtenir une carte entièrement débloquée ?
Certains modèles sont moins limités que d'autres, mais c'est un véritable coup de chance et nous ne ferons aucune promesse que nous ne pourrons tenir. Commandez sur la base de 64 Go de VRAM à petit prix ; tout excédent est un bonus.
Puis-je en exécuter plusieurs sur une seule machine ?
C'est physiquement possible, et chaque carte dispose de ses propres 64 Go, ce qui permet le fonctionnement indépendant des tâches par carte. En revanche, la répartition d'un même modèle sur plusieurs cartes est problématique : avec PCIe 1.0, la communication parallèle des tenseurs constitue un goulot d'étranglement important.
A-t-il besoin d'un refroidissement spécial ?
Oui. C'est une carte passive sans ventilateur intégré, qui nécessite un boîtier serveur avec une bonne ventilation axiale. Elle surchauffera dans un boîtier de bureau classique.
Comment cela se compare-t-il à l'achat d'une carte professionnelle ?
Côté prix de la VRAM, rien ne se compare : environ 25 €/Go ici contre environ 141 €/Go pour une RTX PRO 6000 de 96 Go. En matière de fiabilité, de puissance de calcul, de garantie, de bande passante PCIe et de valeur de revente, la carte professionnelle l'emporte sur tous les points. Choisissez en fonction de vos priorités.
Les questions que les acheteurs nous posent le plus souvent avant de commander un serveur.
Combien de temps faudra-t-il compter ?
Les ordinateurs assemblés avec des composants en stock sont expédiés rapidement ; pour tout appareil nécessitant une génération spécifique de GPU, la disponibilité dépend des stocks. Nous vous communiquons une date avant le paiement et, en cas de changement, nous vous en informons.
La configuration peut-elle être modifiée avant la compilation ?
Presque toujours. Les cartes graphiques, la mémoire, le stockage et le système de refroidissement sont choisis à la commande, et la configuration indiquée est un point de départ et non une configuration fixe. Si vous avez besoin de plus de VRAM, d'un stockage plus rapide ou d'un système de refroidissement différent, veuillez le préciser avant de commander et nous vous ferons parvenir un devis.
Puis-je récupérer le serveur en personne ?
Oui, c'est possible. Notre entrepôt se trouve à Prague et nous vous invitons à venir retirer votre commande sur place. La plupart de nos clients profitent de cette visite pour découvrir la machine avec notre technicien et poser les questions qu'ils n'osent pas poser par e-mail. Pour les commandes en République tchèque, nous essayons également d'assurer la livraison en personne et de vous accompagner lors de l'installation.
Puis-je parler à quelqu'un qui comprend réellement la charge de travail ?
Oui. Nous avons un ingénieur spécialisé en systèmes d'IA, et non un commercial généraliste. Si votre question concerne la taille des lots, la quantification, l'interconnexion ou l'identification de votre goulot d'étranglement, n'hésitez pas à la poser ; cette discussion permet généralement d'améliorer la configuration.
Quel modèle puis-je exécuter sur cette configuration ?
Oui. Chaque machine est assemblée, testée en conditions réelles et évaluée sur des charges de travail d'IA réelles avant son expédition. Nous vous livrons ainsi un LLM déjà installé et opérationnel. Il vous suffit de le brancher, de le connecter à votre réseau et de commencer à travailler : vous n'avez plus qu'à choisir le projet à exécuter en premier.
Comment teste-t-on un serveur avant son expédition ?
Nous effectuons les tests sur des charges de travail d'IA réelles, et non sur des scores synthétiques : débit d'inférence, comportement en charge soutenue et températures en fonctionnement continu. Vous obtenez les résultats du test avec la machine ; les performances promises sont donc celles que vous pouvez vérifier dès le premier jour.
Le serveur est-il prêt à fonctionner dès son arrivée ?
Oui. Chaque machine est assemblée, testée en conditions réelles et évaluée sur des charges de travail d'IA réelles avant son expédition. Nous vous livrons ainsi un LLM déjà installé et opérationnel. Il vous suffit de le brancher, de le connecter à votre réseau et de commencer à travailler : vous n'avez plus qu'à choisir le projet à exécuter en premier.
Expédié depuis notre entrepôt européen. Les articles lourds peuvent nécessiter un transport ; veuillez nous contacter pour obtenir un devis et un délai de livraison. Garantie limitée de 2 ans avec assistance RMA avancée ; extension de garantie disponible.
Ce n'est pas exactement ce dont vous avez besoin ?
Indiquez-nous votre charge de travail et nous adapterons cette plateforme en conséquence : GPU, mémoire, stockage et refroidissement adaptés à votre utilisation réelle.