GRUENCY  /  AI pracovné stanice

AI pracovné stanice na trvalú záťaž

Trénovanie modelov a lokálna inferencia LLM držia počítač na plnom výkone celé hodiny alebo dni. GRUENCY dimenzuje GPU, napájanie a chladenie pre túto nepretržitú záťaž. Každá AI pracovná stanica prechádza pred dodaním záťažovým testom.

Konfigurovať na WS.COMPUTER

Čo sa rozhoduje pred objednávkou

Výpočtový výkon, pamäť, linky PCIe, napájanie a hluk sa špecifikujú spoločne, s východiskom v modeloch, ktoré používate.

  • Trieda GPU a VRAM dimenzované podľa modelov: kvantizácia, dĺžka kontextu a veľkosť dávky
  • Topológia PCIe plánovaná slot po slote, s uvedenou šírkou linky každého GPU
  • Platforma pracovnej stanice alebo servera, s pamäťou ECC tam, kde to práca vyžaduje
  • Napájanie s rezervou nad nameraným trvalým odberom
  • Vodné chladenie alebo vysokotlakové vzduchové chladenie navrhnuté na dohodnutú úroveň hluku
  • Rozloženie úložiska pre dátové sady, kontrolné body a pracovný priestor

Testovanie pred dodaním

Každá AI pracovná stanica opúšťa Varšavu s vlastným protokolom testov. Obsahuje dlhodobý záťažový test pri plnom zaťažení, tepelný profil každého GPU a kontrolu hluku voči dohodnutému cieľu. Po doručení Sebastian uvedie počítač do prevádzky vo vašom prostredí na diaľku. Meria sa aj rýchlosť: výkon GPU a pamäte a tokeny za sekundu pri jazykových modeloch.

Interiér zostavy: vodný blok procesora, hadice okruhu, pamäťové moduly a riadiaca jednotka chladenia v zostave WS.COMPUTER

Predchádzajúca práca

Prototyp, 2017

11 vodou chladených GPU v jednej skrini

Dvojprocesorová serverová platforma v jednej skrini navrhnutej v CAD, chladená jedným vodným okruhom.

Práca pre NVIDIA ako dodávateľ

Systémy pre AI výpočty a vizuálnu produkciu

Dodávateľská práca pre NVIDIA v oblasti AI, renderingu a vizualizačných systémov. Klienti WS.COMPUTER pôsobia vo viac ako 30 krajinách.

Od roku 2011

Multi-GPU zostavy

Počítače naprieč generáciami GPU, každý špecifikovaný pre svoju úlohu.

Otázky k AI pracovným staniciam

Ako sa dimenzuje počítač na lokálnu inferenciu LLM?

Podľa modelov, ktoré používate. Počet parametrov, kvantizácia, dĺžka kontextu a veľkosť dávky určujú potrebnú VRAM a priepustnosť pamäte. Je to prvá otázka pri konzultácii.

Vzduchové alebo vodné chladenie pre počítač na trénovanie?

Závisí to od trvalého príkonu a cieľovej hlučnosti. Dve GPU sa často dajú chladiť vzduchom. Štyri a viac GPU pri nepretržitej záťaži zvyčajne potrebujú vodný okruh na mieru.

Dodávate a uvádzate do prevádzky aj mimo Poľska?

Áno. Počítače dodávame do celej EÚ a do celého sveta v prepravnom balení na mieru. Uvedenie do prevádzky vo vašom prostredí na diaľku je súčasťou každej dodávky.

Požiadať o konzultáciu

Opíšte modely, dáta a miesto, kde bude počítač používaný.

Alebo e-mail info@gruency.com  ·  Konfigurovať na WS.COMPUTER