QDNAConseil et architecture de plateformes d'inférence et d'entraînement de LLM, en local ou hybride

LLM local et conformité dans le secteur public

Le secteur relève du cadre RGPD et SecNumCloud. Servir un modèle dans les murs du client déplace la question du transfert de données.

Réponse courte. Un modèle servi dans les murs du client traite les données sur place. Aucune donnée ne sort du système d’information, ce qui répond au cadre RGPD et SecNumCloud sans dépendre d’un transfert vers un tiers.

Quel cadre s’applique ?

Le secteur relève de RGPD et SecNumCloud. Le point sensible porte sur commande publique et souveraineté. Un traitement réalisé sur site supprime le transfert des données vers un fournisseur, donc la question du lieu d’hébergement et celle du sous-traitant.

Quelles plateformes conviennent ?

Prix indicatifs, non contractuels, hors intégration ; « sur devis » quand aucun vendeur ne publie de tarif. Les sources sont en fin de page. Le dimensionnement dépend du modèle retenu. Voir les pages de dimensionnement pour l’empreinte de chaque modèle sur chaque plateforme.

Illustration en production : gironde.qdna.fr, un site de données publiques conçu, déployé et opéré par QDNA (étude de cas).

Ce que cette page ne dit pas

Cette page décrit une architecture, elle ne constitue pas un avis juridique. La conformité s’apprécie sur le traitement réel, avec le délégué à la protection des données de l’organisation et, le cas échéant, son autorité de contrôle.

Sources officielles

Un LLM local répond-il au RGPD et SecNumCloud ?

Un modèle servi dans les murs du client traite les données sur place. Aucune donnée ne sort du système d’information, ce qui répond au cadre RGPD et SecNumCloud sans dépendre d’un transfert vers un tiers.

Quelle plateforme pour commencer ?

Le choix dépend du modèle visé et du nombre d’utilisateurs. Les pages de dimensionnement donnent l’empreinte mémoire de chaque modèle sur chaque plateforme.

Méthode et sources

Les empreintes mémoire sont calculées, elles ne sont pas mesurées : un relevé sur machine peut s’en écarter selon le moteur et le format exact des poids. Chaque valeur ci-dessous porte sa source et la date de son dernier contrôle.

  • DGX Spark, 128 Go (128 Go LPDDR5X, 273 Go/s, alimentation 240 W, TDP GB10 140 W), fiche constructeur vérifiée le 2 septembre 2026. Prix : 5 850 à 7 511 € TTC, indicatif et non contractuel. Meilleur prix 5 850 € TTC soit 4 875 € HT, relevé sur idealo.fr le 2 septembre 2026.
  • Mac Studio Ultra, 512 Go (M5 Ultra, jusqu’à 512 Go de mémoire unifiée, 1,2 To/s, 480 W en continu ; la variante 512 Go est annoncée pour fin octobre 2026), fiche constructeur vérifiée le 2 septembre 2026. Prix : 6 599 à 20 679 € TTC, indicatif et non contractuel. Apple Store France relevé par MacGeneration le 25 août 2026 : 6 599 € pour le M5 Ultra en 96 Go, 20 679 € en 256 Go et 16 To ; la variante 512 Go n’est pas encore tarifée.
  • DGX Station, 748 Go (252 Go HBM3e (7,1 To/s) et 496 Go LPDDR5X (396 Go/s), 1 600 W, 20 PFLOPS FP4 avec sparsité (15 en dense)), fiche constructeur vérifiée le 2 septembre 2026. Prix : 93 000 à 110 500 € HT, indicatif et non contractuel. Configurations Supermicro, MSI, Exxact, Gigabyte, HP et ASUS relevées par le revendeur pi3g le 27 août 2026, hors TVA et transport.
  • Serveur RTX PRO 6000, 768 Go (96 Go GDDR7 et 1 597 Go/s par carte, 600 W, soit 768 Go pour 8 cartes), fiche constructeur vérifiée le 2 septembre 2026. Prix : sur devis. Aucun constructeur ne publie de tarif pour un serveur à 8 cartes ; la carte seule est affichée 16 000 $ sur la place de marché NVIDIA au 1er septembre 2026 (relevé thundercompute.com).
  • Serveur H200 SXM, 1 128 Go (141 Go HBM3e et 4,8 To/s par GPU, NVLink 900 Go/s, 700 W, soit 1 128 Go pour 8 GPU), fiche constructeur vérifiée le 2 septembre 2026. Prix : environ 453 k€ HT, indicatif et non contractuel. Serveur 8 GPU H200 141 Go et deux Xeon Gold 6538Y+ affiché 387 785 £ chez CTO Servers le 2 septembre 2026, converti au taux BCE de 0,857 £ pour 1 €.
  • B200 SXM, 1 440 Go (HGX B200, 8 GPU Blackwell, 1,4 To de mémoire totale, 144 PFLOPS FP4 avec sparsité (72 en dense), NVLink 1,8 To/s par GPU), fiche constructeur vérifiée le 2 septembre 2026. Prix : sur devis. NVIDIA ne publie pas de tarif ; Aivres annonçait environ 340 000 $ HT pour un serveur HGX B200 (Arc Compute, mise à jour du 30 juillet 2026, signalée comme périmée par l’auteur).
  • B300 SXM, 2 304 Go (HGX B300, 8 GPU Blackwell Ultra à 288 Go, soit 2 304 Go (la fiche HGX arrondit à 2,1 To), 144 PFLOPS FP4 avec sparsité (108 en dense), NVLink 1,8 To/s par GPU), fiche constructeur vérifiée le 2 septembre 2026. Prix : environ 430 à 690 k€ HT, indicatif et non contractuel. BIZON X9000 G5 à 496 728 $ (livraison novembre 2026) et Supermicro AS-8126GS-NB3RT à 795 000 $ chez Vipera, relevés le 2 septembre 2026, convertis au taux BCE de 1,159 $ pour 1 €.
  • GB300 NVL72, 20 700 Go (72 GPU Blackwell Ultra et 36 CPU Grace, 20 To de mémoire GPU selon NVIDIA (72 × 288 Go = 20 736 Go), 37 To de mémoire rapide, NVLink 130 To/s, 1 440 PFLOPS FP4 avec sparsité (1 080 en dense) ; consommation non publiée), fiche constructeur vérifiée le 2 septembre 2026. Prix : sur devis. NVIDIA ne publie pas de tarif ; les estimations d’analystes vont de 3,7 à 6,5 M$ la baie (Loop Capital, Tom’s Hardware, rapportées par Spheron le 16 août 2026).