GRUENCY  /  Stations de travail IA

Stations de travail IA pour charge soutenue

L’entraînement de modèles et l’inférence locale de LLM maintiennent une machine à pleine puissance pendant des heures ou des jours. GRUENCY dimensionne les GPU, l’alimentation et le refroidissement pour cette charge continue. Chaque station de travail IA passe un test de charge prolongé avant livraison.

Configurer sur WS.COMPUTER

Ce qui est décidé avant la commande

Puissance de calcul, mémoire, lignes PCIe, alimentation et niveau sonore sont spécifiés ensemble, à partir des modèles que vous exécutez.

  • Classe de GPU et VRAM dimensionnées selon les modèles : quantification, longueur de contexte et taille de lot
  • Topologie PCIe planifiée emplacement par emplacement, avec la largeur de lien de chaque GPU indiquée
  • Plateforme station de travail ou serveur, avec mémoire ECC lorsque le travail l’exige
  • Alimentation dimensionnée avec une marge au-dessus de la consommation soutenue mesurée
  • Refroidissement par eau ou par air à haute pression, conçu pour un niveau sonore cible convenu
  • Organisation du stockage pour les jeux de données, les points de contrôle et l’espace de travail temporaire

Tests avant livraison

Chaque station de travail IA quitte Varsovie avec son propre rapport de test. Il comprend un test de charge prolongé à pleine puissance, un profil thermique pour chaque GPU et un contrôle du niveau sonore par rapport à l’objectif convenu. À la réception, Sebastian met la machine en service à distance dans votre environnement.

Intérieur d’une machine WS.COMPUTER : bloc à eau du CPU, tubes du circuit, barrettes de mémoire et contrôleur de liquide de refroidissement

Réalisations

Prototype, 2017

11 GPU refroidis par eau dans un seul châssis

Une plateforme serveur bi-processeur dans un seul boîtier conçu en CAO, refroidie par un circuit d’eau unique.

Fournisseur de NVIDIA

Systèmes de calcul IA et de production visuelle

Travaux en tant que fournisseur de NVIDIA sur des systèmes d’IA, de rendu et de visualisation. Les clients de WS.COMPUTER sont implantés dans plus de 30 pays.

Depuis 2014

Machines multi-GPU

Des machines sur plusieurs générations successives de GPU, chacune spécifiée pour sa charge de travail.

Questions sur les stations de travail IA

Comment dimensionner une machine pour l’inférence locale de LLM ?

À partir des modèles que vous exécutez. Le nombre de paramètres, la quantification, la longueur de contexte et la taille de lot déterminent la VRAM et la bande passante mémoire nécessaires. C’est la première question abordée lors de la consultation.

Refroidissement par air ou par eau pour une machine d’entraînement ?

Cela dépend de la consommation soutenue et du niveau sonore cible. Deux GPU peuvent souvent être refroidis par air. Quatre GPU ou plus en charge continue nécessitent généralement un circuit de refroidissement par eau sur mesure.

Livrez-vous et mettez-vous en service hors de Pologne ?

Oui. Les machines sont livrées dans toute l’UE et dans le monde entier, dans un emballage de transport sur mesure. La mise en service à distance dans votre environnement fait partie de chaque livraison.

Demander une consultation

Décrivez les modèles, les données et le lieu où la machine sera utilisée.

Ou écrivez à info@gruency.com  ·  Configurer sur WS.COMPUTER