GRUENCY  /  Stații de lucru AI

Stații de lucru AI pentru sarcină susținută

Antrenarea modelelor și inferența LLM locală țin o mașină la putere maximă ore sau zile întregi. GRUENCY dimensionează GPU-urile, alimentarea și răcirea pentru această sarcină continuă. Fiecare stație de lucru AI este testată prin burn-in înainte de livrare.

Configurați pe WS.COMPUTER

Ce se stabilește înainte de comandă

Puterea de calcul, memoria, liniile PCIe, alimentarea și zgomotul sunt specificate împreună, pornind de la modelele pe care le rulați.

  • Clasa GPU și VRAM dimensionate pentru modele: cuantizare, lungimea contextului și dimensiunea lotului
  • Topologie PCIe planificată slot cu slot, cu lățimea legăturii fiecărui GPU precizată
  • Platformă de stație de lucru sau de server, cu memorie ECC acolo unde munca o cere
  • Alimentare cu rezervă față de consumul susținut măsurat
  • Răcire cu lichid sau cu aer de înaltă presiune, proiectată pentru o țintă de zgomot convenită
  • Organizarea stocării pentru seturi de date, checkpointuri și spațiu de lucru temporar

Testare înainte de livrare

Fiecare stație de lucru AI pleacă din Varșovia cu propriul raport de testare. Acesta include un burn-in susținut la sarcină maximă, un profil termic pentru fiecare GPU și o verificare a zgomotului față de ținta convenită. La sosire, Sebastian pune mașina în funcțiune de la distanță în mediul dumneavoastră. Se măsoară și viteza: performanța GPU și a memoriei, precum și tokenii pe secundă pentru modele lingvistice.

Interiorul construcției: bloc de apă pentru CPU, tuburile circuitului, bancuri de memorie și controlerul lichidului de răcire într-o construcție WS.COMPUTER

Lucrări anterioare

Prototip, 2017

11 GPU-uri răcite cu lichid într-o singură carcasă

O platformă server dual-CPU într-o singură carcasă proiectată în CAD, răcită de un singur circuit de lichid.

Lucrări ca furnizor pentru NVIDIA

Sisteme de calcul AI și de producție vizuală

Lucrări ca furnizor pentru NVIDIA în domeniul sistemelor AI, de randare și de vizualizare. Clienții WS.COMPUTER provin din peste 30 de țări.

Din 2011

Construcții multi-GPU

Mașini din generații succesive de GPU-uri, fiecare specificată pentru sarcina sa de lucru.

Întrebări despre stațiile de lucru AI

Cum se dimensionează o mașină pentru inferență LLM locală?

Pornind de la modelele pe care le rulați. Numărul de parametri, cuantizarea, lungimea contextului și dimensiunea lotului determină VRAM-ul și lățimea de bandă a memoriei necesare. Aceasta este prima întrebare din consultație.

Răcire cu aer sau cu lichid pentru o mașină de antrenare?

Depinde de consumul susținut și de ținta de zgomot. Două GPU-uri pot fi adesea răcite cu aer. Patru sau mai multe GPU-uri sub sarcină continuă necesită de obicei un circuit de răcire cu lichid personalizat.

Livrați și puneți în funcțiune și în afara Poloniei?

Da. Mașinile sunt livrate în toată UE și în întreaga lume, în ambalaje de transport personalizate. Punerea în funcțiune de la distanță în mediul dumneavoastră face parte din fiecare livrare.

Solicitați o consultație

Descrieți modelele, datele și locul în care va fi folosită mașina.

Sau prin e-mail info@gruency.com  ·  Configurați pe WS.COMPUTER