Concevez votre serveur d'IA
Choisissez les applications que vous souhaitez exécuter. Nous concevons une machine, affichons les modèles qu'elle peut héberger sur site et calculons son prix en temps réel selon les conditions de configuration de Kentino : format, GPU, mémoire et consommation électrique, tous les paramètres étant ajustables.
1Que va-t-il faire ?définit une base de construction initiale
2Ajuster la configurationlimité à ce que nous expédions
Les estimations sont des tarifs hors TVA, calculés selon les conditions de fabrication standard de Kentino ; le devis définitif sera confirmé à la commande (délai de livraison : 10 à 28 jours). Les modèles de classe LLM mutualisent la VRAM entre les GPU via le parallélisme tensoriel (la mise à l’échelle n’est pas linéaire ; le parallélisme dense est moins performant que le MoE).
Les modèles vidéo, image et audio ne peuvent pas être répartis entre les GPU. Chaque carte doit être compatible avec la VRAM d'une seule carte ; les cartes supplémentaires ajoutent des tâches en parallèle, sans pour autant proposer des modèles plus performants. L'alimentation redondante n'est pas silencieuse (environ 60 dB). Les configurations sur mesure (AMD Instinct, onduleur/NAS intégré) font l'objet d'un devis séparé.