QDNAConseil et architecture de plateformes d'inférence et d'entraînement de LLM, en local ou hybride

DGX Station

Workstation, superpuce GB300 Desktop

Réponse courte. La DGX Station est une workstation d’intelligence artificielle articulée autour de la superpuce GB300 Desktop. Elle sert les grands modèles en local et le réglage fin confortable, sous vLLM avec Unsloth, dans un boîtier de bureau sans salle serveur. Une station complète avoisine 126 000 euros à titre d’estimation.
DGX Station
Prix indicatifde 117 000 à 169 000 €, estimation hors intégration (guide des prix)
Mémoire784 Go annoncée, 748 Go finale (252 HBM3e et 496 LPDDR5X)
GPUBlackwell Ultra GB300 Desktop et Grace 72 cœurs
Calculenviron 20 PFLOPS FP4
RéseauConnectX-8 SuperNIC 800 GbE
Modèlesjusqu’à 1000 milliards de paramètres
FormatStation de travail

Que permet la DGX Station ?

Grands modèles en local et réglage fin confortable. Runtime conseillé : vLLM avec Unsloth.

Pour qui la DGX Station est-elle pensée ?

La PME dispose d’une baie dans un boîtier pour développer et servir sans salle serveur. Une station complète avoisine 126 000 euros à titre d’estimation.

Constructeurs

La DGX Station est assemblée par ASUS, Dell, Gigabyte, MSI et Supermicro autour de la carte GB300 fournie par NVIDIA.

Stockage GPUDirect

Sur les plateformes équipées de cartes ConnectX, la technologie GPUDirect Storage établit un chemin direct entre le stockage NVMe ou NVMe over Fabric et la mémoire du GPU, sans passer par le tampon du processeur. Le débit soutenu atteint environ 50 gigaoctets par seconde par lien. Les baies compatibles, telles NetApp, VAST, DDN ou WEKA, alimentent l’entraînement et le RAG massif à pleine vitesse.

Support

Pile ouverte supportée par QDNA et les communautés. Option NVIDIA AI Enterprise (NIM, NeMo, Triton) avec engagement de niveau de service, par carte.

Questions fréquentes

Combien coûte une DGX Station ?

Une station complète avoisine 126 000 euros à titre d’estimation, selon la configuration et le constructeur.

À quoi sert la DGX Station ?

À développer et servir de grands modèles en local, avec un réglage fin confortable, sans salle serveur : une baie dans un boîtier de bureau pour une PME.

Quel runtime pour la DGX Station ?

vLLM avec Unsloth, pour le service et le réglage fin des grands modèles.

DGX Station ou DGX Spark ?

Le DGX Spark est un poste compact pour les modèles jusqu’à 200 milliards de paramètres ; la DGX Station, plus puissante et plus chère, vise le développement et le service de plus grands modèles.

Combien coûte un dgx station configuré pour un LLM ?

Le tarif varie selon la configuration choisie et le fournisseur. Nous communiquons des plages indicatives dans la fiche et un devis détaillé après cadrage.

Quel modèle LLM fait tenir dans un dgx station ?

Selon le format de quantification et le contexte d'entrée. Le tableau de la page indique la taille de modèle maximale recommandée.

Quels runtimes sont compatibles avec le dgx station ?

vLLM, llama.cpp, Triton Inference Server selon le framework retenu. Les versions testées par QDNA sont listées en bas de fiche.

Configurer ce matériel

Un échange sans engagement pour dimensionner votre plateforme.

Réserver un échange

Quels modèles tiennent sur DGX Station ?

La machine offre 748 Go de mémoire HBM3e et LPDDR5X. 5 des 7 modèles ouverts du catalogue y logent, dans le format indiqué.

Voir la matrice complète.