GRUENCY  /  KI-Workstations

KI-Workstations für Dauerlast

Modelltraining und lokale LLM-Inferenz halten eine Maschine über Stunden oder Tage unter voller Leistung. GRUENCY dimensioniert GPUs, Stromversorgung und Kühlung für diese Dauerlast. Jede KI-Workstation durchläuft vor der Auslieferung einen Burn-in-Test.

Bei WS.COMPUTER konfigurieren

Was vor der Bestellung festgelegt wird

Rechenleistung, Speicher, PCIe-Lanes, Stromversorgung und Geräuschpegel werden gemeinsam spezifiziert, ausgehend von den Modellen, die Sie einsetzen.

  • GPU-Klasse und VRAM passend zu den Modellen dimensioniert: Quantisierung, Kontextlänge und Batchgröße
  • PCIe-Topologie Steckplatz für Steckplatz geplant, mit Angabe der Anbindungsbreite jeder GPU
  • Workstation- oder Serverplattform, mit ECC-Speicher, wo die Arbeit es erfordert
  • Stromversorgung mit Reserve gegenüber der gemessenen Dauerleistungsaufnahme
  • Wasserkühlung oder Luftkühlung mit Hochdrucklüftern, ausgelegt auf einen vereinbarten Geräuschpegel
  • Aufteilung des Massenspeichers für Datensätze, Checkpoints und temporäre Arbeitsdaten

Prüfung vor der Auslieferung

Jede KI-Workstation verlässt Warschau mit einem eigenen Prüfprotokoll. Es umfasst einen Burn-in-Test unter anhaltender Volllast, ein Temperaturprofil für jede GPU und eine Geräuschmessung im Abgleich mit dem vereinbarten Zielwert. Nach der Ankunft nimmt Sebastian die Maschine per Fernzugriff in Ihrer Umgebung in Betrieb.

Blick in einen Aufbau: CPU-Wasserkühler, Schläuche des Kühlkreislaufs, Speicherbänke und Kühlmittel-Controller in einem WS.COMPUTER-System

Bisherige Arbeiten

Prototyp, 2017

11 wassergekühlte GPUs in einem Gehäuse

Eine Dual-CPU-Serverplattform in einem einzigen, per CAD konstruierten Gehäuse, gekühlt über einen Wasserkreislauf.

Lieferant für NVIDIA

Systeme für KI-Berechnungen und visuelle Produktion

Tätigkeit als Lieferant für NVIDIA bei KI-, Rendering- und Visualisierungssystemen. Kunden von WS.COMPUTER sitzen in über 30 Ländern.

Seit 2014

Multi-GPU-Aufbauten

Maschinen über mehrere GPU-Generationen hinweg, jede für ihre Anwendung spezifiziert.

Fragen zu KI-Workstations

Wie wird eine Maschine für lokale LLM-Inferenz dimensioniert?

Ausgehend von den Modellen, die Sie einsetzen. Parameterzahl, Quantisierung, Kontextlänge und Batchgröße bestimmen den Bedarf an VRAM und Speicherbandbreite. Das ist die erste Frage im Beratungsgespräch.

Luft- oder Wasserkühlung für eine Trainingsmaschine?

Das hängt von der anhaltenden Leistungsaufnahme und dem Zielwert für den Geräuschpegel ab. Zwei GPUs lassen sich oft mit Luft kühlen. Vier oder mehr GPUs unter Dauerlast erfordern in der Regel einen individuellen Wasserkreislauf.

Liefern Sie auch außerhalb Polens und übernehmen dort die Inbetriebnahme?

Ja. Die Maschinen werden in eigens angefertigter Transportverpackung in die gesamte EU und weltweit geliefert. Die Inbetriebnahme per Fernzugriff in Ihrer Umgebung ist Teil jeder Lieferung.

Beratungsgespräch anfragen

Beschreiben Sie die Modelle, die Daten und den Einsatzort der Maschine.

Oder per E-Mail an info@gruency.com  ·  Konfiguration bei WS.COMPUTER