NVIDIA CMP 170HX 64 Go HBM2e (Modifiée, ex-minage)
NVIDIA CMP 170HX 64 Go HBM2e (Modifiée, ex-minage)
NVIDIA CMP 170HX 64 Go HBM2e (Modifiée, ex-minage)
NVIDIA CMP 170HX 64 Go HBM2e (Modifiée, ex-minage)
NVIDIA CMP 170HX 64 Go HBM2e (Modifiée, ex-minage)
Kentino · Serveur d'IA personnalisé

NVIDIA CMP 170HX 64 Go HBM2e (Modifiée, ex-minage)

Plateforme de niveau entreprise, assemblée et testée dans l'UE.

€1.600,00Hors TVA · Frais de port calculés lors du paiement
En stock — expédié depuis un entrepôt de l'UE
ISO 9001 · matériel vérifiéEntrepôt et garantie en UEPlus de 7 ans d'expérience en IA d'entrepriseTest de rodage effectué avant expédition
Marché
Livraison et garantie
Modifiée · Anciennement utilisée pour le minage · 64 Go HBM2e

NVIDIA CMP 170HX 64 Go HBM2e — Mémoire vidéo économique pour l'inférence résidente

Il s'agit d'un CMP 170HX basé sur un chipset GA100, dont la mémoire a été étendue à 64 Go de HBM2e. À 1 600 €, cela représente environ 25 € par gigaoctet de VRAM à large bande passante, soit environ un cinquième du prix des cartes graphiques professionnelles à grande capacité de VRAM. Ce matériel modifié présente des limitations réelles, que nous détaillons ci-dessous avant tout achat.

64 GB
VRAM HBM2e
GA100
GPU Ampere
~ 25 €/GB
coût de la VRAM
PCIe 1.0
Lien ×4 ou ×16
Lisez ceci en premier

Ce que cette carte est — et n'est pas

La CMP 170HX était commercialisée par NVIDIA comme une carte dédiée au minage : une GA100 allégée dont l’interface PCIe était volontairement limitée à la norme PCIe 1.0 et la plupart des fonctions d’affichage et de calcul restreintes. Ces unités ont été modifiées ultérieurement pour embarquer 64 Go de mémoire HBM2e. Elles constituent ainsi une solution particulièrement économique pour stocker un modèle volumineux entièrement en mémoire à large bande passante, mais un mauvais choix pour toute application nécessitant des transferts rapides vers l’hôte, le multi-GPU ou l’entraînement de programmes.

Il s'agit de matériel modifié fonctionnant en dehors de sa configuration prévue. La puissance de calcul est partiellement bridée par rapport à une A100 complète ; privilégiez donc la capacité de la VRAM plutôt que le débit pour votre achat. Les performances des cartes varient : certaines sont plus ou moins débridées que d'autres, et nous ne pouvons garantir celle que vous recevrez. Si vous avez besoin d'une puissance de calcul stable et prévisible, optez plutôt pour une RTX PRO 6000 ou une carte graphique dédiée aux centres de données ; nous serons ravis de vous faire un devis.
La limite PCIe

Pourquoi l'option ×16 coûte 150 € de plus

Les deux versions sont verrouillées sur la signalisation PCIe 1.0 ; cette configuration est irréversible. La différence réside dans le nombre de voies, ce qui multiplie par 4 la bande passante entre l’hôte et la carte.

PCIe 1.0 ×4 — 1 750 € ~1 Go/s · Remplir 64 Go prend environ une minute
PCIe 1.0 ×16 — 1 750 € ~4 Go/s · Remplir 64 Go prend environ 15 secondes
Une fois les poids stockés dans la VRAM, l'inférence s'effectue depuis la mémoire HBM2e et la liaison PCIe n'a quasiment aucune importance. C'est la vitesse de la liaison qui prime. temps de chargement du modèleLe streaming hôte↔périphérique et toute communication multi-GPU sont pris en charge. Si vous chargez un modèle une seule fois et l'utilisez pendant des heures, ×4 suffit. En revanche, si vous changez fréquemment de modèle, diffusez des données en continu ou prévoyez de répartir un modèle sur plusieurs cartes, optez pour la version ×4 à 150 €.
Les deux options proviennent du même lot de cartes. La conversion x16 est effectuée en interne avant l'expédition, et c'est ce que couvrent les 150 €. Veuillez prévoir un délai supplémentaire pour les commandes x16 afin de permettre la conversion et les nouveaux tests.
Spécifications techniques

Données techniques

GPU NVIDIA GA100 — Ampère
Mémoire 64 Go HBM2e (modifiée — configuration non standard)
calcul Fusion partielle désactivée par rapport à l'A100 — axée sur la capacité, et non sur le débit
Interface PCIe 1.0 ×4 ou PCIe 1.0 ×16 (à sélectionner ci-dessus)
Bande passante de l'hôte ~1 Go/s (×4) · ~4 Go/s (×16)
Affichage des sorties Aucun — calcul uniquement
Refroidissement Passif — nécessite un flux d'air dans le châssis
État Matériel d'occasion, provenant du secteur minier — testé avant expédition
Garantie — carte 6 mois
Garantie — VRAM modifiée 14 jours
Meilleur pour

Où ça s'intègre

  • Un seul modèle volumineux, résidant dans la VRAM, est utilisé : il est chargé une seule fois et fonctionne pendant des heures.
  • Expérimenter avec des modèles haut de gamme à petit budget, où l'intérêt principal réside dans le fait de proposer 64 Go pour 1 600 €.
  • Les tâches d'inférence par lots qui sont limitées par la VRAM plutôt que par le transfert.
  • Apprentissage et développement sur les flux de travail de modèles de grande envergure sans dépenses liées aux GPU de centres de données.

Là où cela ne convient pas

  • Entraînement ou réglage fin — PCIe 1.0 et puissance de calcul réduite sont deux obstacles à surmonter.
  • Configurations multi-GPU parallèles de tenseurs — l'interconnexion est beaucoup trop lente.
  • Charges de travail qui diffusent des données en continu depuis la mémoire ou le disque de l'hôte.
  • Tout appareil nécessitant un affichage, ou une carte graphique sur laquelle vous pouvez compter pendant des années en production.
Questions que

QFP

Pourquoi la garantie de la VRAM n'est-elle que de 14 jours ?

La configuration mémoire de 64 Go étant une modification non officielle, le matériel n'a jamais été conçu pour cela. Nous testons chaque carte avant expédition, mais nous ne prétendons pas qu'un sous-système mémoire modifié bénéficie de la même garantie à long terme qu'une pièce d'origine. La carte elle-même est garantie 6 mois ; la VRAM modifiée, 14 jours. Veuillez la tester correctement dès réception.

Mon système d'exploitation reconnaîtra-t-il la totalité des 64 Go ?

Nos tests ont démontré que la totalité de la capacité est adressable, ce qui justifie pleinement l'achat de cette carte. La capacité de calcul, quant à elle, est partiellement limitée par rapport à une véritable A100, et varie d'une carte à l'autre. Veuillez nous indiquer votre charge de travail prévue avant de commander ; nous vous indiquerons clairement si cet achat est judicieux.

Puis-je obtenir une carte entièrement débloquée ?

Certains modèles sont moins limités que d'autres, mais c'est un véritable coup de chance et nous ne ferons aucune promesse que nous ne pourrons tenir. Commandez sur la base de 64 Go de VRAM à petit prix ; tout excédent est un bonus.

Puis-je en exécuter plusieurs sur une seule machine ?

C'est physiquement possible, et chaque carte dispose de ses propres 64 Go, ce qui permet le fonctionnement indépendant des tâches par carte. En revanche, la répartition d'un même modèle sur plusieurs cartes est problématique : avec PCIe 1.0, la communication parallèle des tenseurs constitue un goulot d'étranglement important.

A-t-il besoin d'un refroidissement spécial ?

Oui. C'est une carte passive sans ventilateur intégré, qui nécessite un boîtier serveur avec une bonne ventilation axiale. Elle surchauffera dans un boîtier de bureau classique.

Comment cela se compare-t-il à l'achat d'une carte professionnelle ?

Côté prix de la VRAM, rien ne se compare : environ 25 €/Go ici contre environ 141 €/Go pour une RTX PRO 6000 de 96 Go. En matière de fiabilité, de puissance de calcul, de garantie, de bande passante PCIe et de valeur de revente, la carte professionnelle l'emporte sur tous les points. Choisissez en fonction de vos priorités.

Vous hésitez sur le choix de cette carte pour votre charge de travail ? Décrivez-nous votre modèle et son utilisation prévue, et nous vous indiquerons en toute franchise si cette carte ou une carte Kentino AI est plus adaptée.

Expédié depuis notre entrepôt européen. Les articles lourds peuvent nécessiter un transport ; veuillez nous contacter pour obtenir un devis et un délai de livraison. Garantie limitée de 2 ans avec assistance RMA avancée ; extension de garantie disponible.

Ce n'est pas exactement ce dont vous avez besoin ?

Indiquez-nous votre charge de travail et nous adapterons cette plateforme en conséquence : GPU, mémoire, stockage et refroidissement adaptés à votre utilisation réelle.