NVIDIA GeForce RTX 4090 24 Go GDDR6X (Reconditionnée)
Plateforme de niveau entreprise, assemblée et testée dans l'UE.
NVIDIA GeForce RTX 4090 — 24 Go pour l'IA sur site
Une RTX 4090 reconditionnée par des professionnels : 24 Go de GDDR6X et calcul Ada Lovelace, testée et vérifiée stable sous charge soutenue. La carte idéale pour l’inférence LLM multi-GPU et l’IA sur station de travail, à un prix bien inférieur à celui des GPU de centres de données.
Le monstre de 24 Go pour l'inférence IA
La RTX 4090 associe 24 Go de GDDR6X à 16 384 cœurs CUDA Ada Lovelace et des cœurs Tensor de 4e génération, offrant ainsi une mémoire vidéo suffisante pour gérer aisément des modèles quantifiés de 7 à 13 milliards d'octets, ou pour exécuter un modèle de 70 milliards d'octets sur deux à quatre cartes. Elle constitue la base en termes de rapport prix/performances des configurations d'IA multi-GPU de Kentino. Chaque unité reconditionnée est nettoyée, inspectée et soumise à des tests de résistance avant son expédition.
Données techniques
| GPU | NVIDIA AD102 — Ada Lovelace |
| Mémoire | 24 Go GDDR6X, 384 bits |
| Bande passante mémoire | ~ 1,008 Go/s |
| Cœurs CUDA | 16,384 |
| Noyaux tenseurs | 512 (4e génération) · jusqu'à ~330 TFLOPS FP16 |
| noyaux RT | 128 (3e génération) |
| Interface | PCIe 4.0 × 16 |
| Puissance du conseil | 450 W (16 broches 12VHPWR) |
| État | Remis à neuf — testé en laboratoire, stabilité vérifiée |
Où ça s'intègre
- Inférence LLM sur site — Les hôtes de 24 Go ont quantifié des modèles de 7 à 13 milliards de dollars ; passage à 70 milliards de dollars sur plusieurs cartes.
- Stations de travail IA et mise au point de modèles de petite et moyenne taille.
- Charges de travail liées au rendu, à la simulation et à la création de contenu.
- Serveurs multi-GPU économiques, là où les GPU de centres de données sont surdimensionnés.
QFP
Que signifie « remis à neuf » dans ce contexte ?
La carte a été nettoyée par un professionnel, inspectée visuellement et soumise à des tests de résistance pour garantir sa stabilité et le bon fonctionnement de sa mémoire VRAM avant expédition. Il ne s'agit pas d'un produit neuf destiné au commerce.
Peut-il faire fonctionner un modèle 70B ?
Pas sur une seule carte : un modèle 70B en 4 bits nécessite environ 40 Go de VRAM. Deux à quatre RTX 4090 (48 à 96 Go au total) gèrent cette tâche grâce à l’inférence parallèle par tenseurs.
Est-ce compatible avec un serveur standard ?
La RTX 4090 est une carte graphique imposante occupant trois emplacements. Elle est compatible avec les boîtiers tour et rack 4U ; vérifiez la disponibilité des emplacements et du connecteur d'alimentation 16 broches dans votre boîtier.
Les questions que les acheteurs nous posent le plus souvent avant de commander un serveur.
Combien de temps faudra-t-il compter ?
Les ordinateurs assemblés avec des composants en stock sont expédiés rapidement ; pour tout appareil nécessitant une génération spécifique de GPU, la disponibilité dépend des stocks. Nous vous communiquons une date avant le paiement et, en cas de changement, nous vous en informons.
La configuration peut-elle être modifiée avant la compilation ?
Presque toujours. Les cartes graphiques, la mémoire, le stockage et le système de refroidissement sont choisis à la commande, et la configuration indiquée est un point de départ et non une configuration fixe. Si vous avez besoin de plus de VRAM, d'un stockage plus rapide ou d'un système de refroidissement différent, veuillez le préciser avant de commander et nous vous ferons parvenir un devis.
Puis-je récupérer le serveur en personne ?
Oui, c'est possible. Notre entrepôt se trouve à Prague et nous vous invitons à venir retirer votre commande sur place. La plupart de nos clients profitent de cette visite pour découvrir la machine avec notre technicien et poser les questions qu'ils n'osent pas poser par e-mail. Pour les commandes en République tchèque, nous essayons également d'assurer la livraison en personne et de vous accompagner lors de l'installation.
Puis-je parler à quelqu'un qui comprend réellement la charge de travail ?
Oui. Nous avons un ingénieur spécialisé en systèmes d'IA, et non un commercial généraliste. Si votre question concerne la taille des lots, la quantification, l'interconnexion ou l'identification de votre goulot d'étranglement, n'hésitez pas à la poser ; cette discussion permet généralement d'améliorer la configuration.
Quel modèle puis-je exécuter sur cette configuration ?
Oui. Chaque machine est assemblée, testée en conditions réelles et évaluée sur des charges de travail d'IA réelles avant son expédition. Nous vous livrons ainsi un LLM déjà installé et opérationnel. Il vous suffit de le brancher, de le connecter à votre réseau et de commencer à travailler : vous n'avez plus qu'à choisir le projet à exécuter en premier.
Comment teste-t-on un serveur avant son expédition ?
Nous effectuons les tests sur des charges de travail d'IA réelles, et non sur des scores synthétiques : débit d'inférence, comportement en charge soutenue et températures en fonctionnement continu. Vous obtenez les résultats du test avec la machine ; les performances promises sont donc celles que vous pouvez vérifier dès le premier jour.
Le serveur est-il prêt à fonctionner dès son arrivée ?
Oui. Chaque machine est assemblée, testée en conditions réelles et évaluée sur des charges de travail d'IA réelles avant son expédition. Nous vous livrons ainsi un LLM déjà installé et opérationnel. Il vous suffit de le brancher, de le connecter à votre réseau et de commencer à travailler : vous n'avez plus qu'à choisir le projet à exécuter en premier.
Expédié depuis notre entrepôt européen. Les articles lourds peuvent nécessiter un transport ; veuillez nous contacter pour obtenir un devis et un délai de livraison. Garantie limitée de 2 ans avec assistance RMA avancée ; extension de garantie disponible.
Ce n'est pas exactement ce dont vous avez besoin ?
Indiquez-nous votre charge de travail et nous adapterons cette plateforme en conséquence : GPU, mémoire, stockage et refroidissement adaptés à votre utilisation réelle.