Kentino · Serveur d'IA personnalisé

NVIDIA RTX PRO 6000 Blackwell Workstation Edition 96 Go GDDR7 ECC

Plateforme de niveau entreprise, assemblée et testée dans l'UE.

€14.507,94Hors TVA · Frais de port calculés lors du paiement
En stock — expédié depuis un entrepôt de l'UE
ISO 9001 · matériel vérifiéEntrepôt et garantie en UEPlus de 7 ans d'expérience en IA d'entrepriseTest de rodage effectué avant expédition
Marché
Livraison et garantie
Blackwell · 96 Go ECC · 600 W

NVIDIA RTX PRO 6000 Blackwell Workstation Edition — 96 Go

La carte professionnelle Blackwell haute performance : 96 Go de mémoire GDDR7 ECC unifiée et 24 064 cœurs CUDA, pour une consommation maximale de 600 W. Il s’agit de notre option mono-GPU la plus rapide pour l’entraînement local de modèles, l’optimisation et l’inférence intensive.

96 GB
VRAM GDDR7 ECC
24,064
Cœurs CUDA
~ 1.8 Toxicité/s
Bande passante mémoire
600 W
Puissance du conseil
Marché

débit maximal d'un seul GPU

Voici la version non bridée de la carte : elle intègre la même mémoire ECC unifiée de 96 Go que la Max-Q, mais avec une limite de consommation portée à 600 W afin que le GPU puisse maintenir des fréquences élevées sous charge soutenue. C’est dans cette marge de manœuvre que les performances supplémentaires se font sentir pour les tâches gourmandes en calcul (réglage fin, entraînements longs, inférence par lots, rendu intensif et simulation). Une seule carte peut gérer un modèle de 70 milliards de classes en 4 bits, avec suffisamment d’espace pour les contextes longs ; il n’y a donc pas de répartition parallèle des tenseurs à gérer.

Spécifications techniques

Données techniques

GPU NVIDIA GB202 — Blackwell
Numéro de fabricant 900-5G144
Mémoire 96 Go GDDR7 ECC, 512 bits
Bande passante mémoire ~1.8 To/s
Cœurs CUDA 24,064
Noyaux tenseurs 752 (5e génération) · ~2,000 TOPS INT8
noyaux RT 188 (4e génération)
Interface PCIe 5.0 × 16
Puissance du conseil 600 W (16 broches 12 V - 2×6)
Refroidissement Flux actif, double fente
Affichage des sorties 4 ports DisplayPort 2.1b
Garantie Garantie du fabricant de 3
Meilleur pour

Où ça s'intègre

  • Réglage et entraînement locaux où c'est la puissance de calcul soutenue, et non seulement la capacité de la VRAM, qui donne le rythme.
  • Inférence 70B sur une seule carte avec un contexte long entièrement stocké dans un seul pool de mémoire.
  • Service d'inférence par lots ou multi-utilisateurs où le débit par carte est important.
  • Visualisation professionnelle, rendu et simulation, ainsi que développement en intelligence artificielle.
  • Stations de travail où une carte graphique haute performance est préférable à plusieurs GPU moins puissants.
Planifiez l'alimentation et le refroidissement avant l'achat : avec une consommation de 600 W, cette carte nécessite une alimentation de qualité avec une marge de puissance suffisante et un boîtier capable de dissiper efficacement la chaleur. Nous dimensionnons l'alimentation et le flux d'air pour chaque configuration que nous fournissons.
Questions que

QFP

Devrais-je prendre celui-ci ou le Max-Q ?

Les deux modèles offrent la même capacité de 96 Go et exécutent donc les mêmes modèles. Choisissez celui-ci si votre application nécessite une puissance de calcul importante et que vous pouvez fournir 600 W d'alimentation et de refroidissement. Optez pour le Max-Q si la consommation d'énergie, la chaleur ou le bruit sont vos principaux critères : il coûte moins cher et consomme deux fois moins d'énergie pour une capacité de VRAM équivalente.

De quelle alimentation ai-je besoin ?

Pour une seule carte graphique, prévoyez une alimentation ATX 3.0 de qualité supérieure d'au moins 1 200 W avec un connecteur 12 V-2×6 à 16 broches natif, et davantage si vous l'associez à un processeur multicœur. Nous intégrons systématiquement cette configuration dans les machines que nous assemblons.

Puis-je en exécuter plusieurs ?

Oui, mais 600 W par carte, ça monte vite ! Les configurations multi-cartes nécessitent une conception soignée de l’alimentation et du flux d’air, et dans la plupart des boîtiers, le Max-Q est le meilleur choix pour une configuration multi-GPU. Contactez-nous avant de vous engager sur une configuration multi-cartes.

Est-ce la même chose que l'édition serveur ?

Non. La version serveur est refroidie passivement grâce à une circulation d'air d'avant en arrière dans le rack et ne possède pas de sorties vidéo. Cette carte est refroidie activement et dispose de quatre sorties DisplayPort ; elle est conçue pour les stations de travail et les configurations tour.

Quel est le délai de livraison?

Délai de livraison habituel : 10 à 21 jours, fabrication sur commande. La disponibilité de cette pièce évolue rapidement ; n’hésitez pas à nous contacter pour confirmation avant de planifier une date.

Vous souhaitez intégrer cette carte dans une machine complète ? Kentino assemble, teste et met en service des serveurs et des stations de travail RTX PRO 6000 AI complets — demandez-nous une configuration personnalisée.

Expédié depuis notre entrepôt européen. Les articles lourds peuvent nécessiter un transport ; veuillez nous contacter pour obtenir un devis et un délai de livraison. Garantie limitée de 2 ans avec assistance RMA avancée ; extension de garantie disponible.

Ce n'est pas exactement ce dont vous avez besoin ?

Indiquez-nous votre charge de travail et nous adapterons cette plateforme en conséquence : GPU, mémoire, stockage et refroidissement adaptés à votre utilisation réelle.