GRUENCY  /  Станции для ИИ

Станции для ИИ под длительную нагрузку

Обучение моделей и локальный инференс LLM держат машину на полной мощности часами или сутками. GRUENCY подбирает GPU, питание и охлаждение под такую непрерывную нагрузку. Каждая станция для ИИ проходит стресс-тест перед поставкой.

Сконфигурировать на WS.COMPUTER

Что решается до заказа

Вычисления, память, линии PCIe, питание и шум определяются вместе, исходя из моделей, которые вы запускаете.

  • Класс GPU и объём VRAM под модели: квантизация, длина контекста и размер батча
  • Топология PCIe спланирована по слотам, с указанием ширины канала каждого GPU
  • Платформа рабочей станции или сервера, с памятью ECC там, где этого требует работа
  • Питание с запасом относительно измеренного длительного потребления
  • Водяное или мощное воздушное охлаждение, рассчитанное на согласованный уровень шума
  • Схема накопителей для датасетов, контрольных точек и временных данных

Проверка перед поставкой

Каждая станция для ИИ уезжает из Варшавы с собственным протоколом испытаний. В него входят длительный стресс-тест под полной нагрузкой, тепловой профиль каждого GPU и проверка шума по согласованному значению. После доставки Sebastian удалённо вводит машину в эксплуатацию в вашей среде. Измеряется и скорость: производительность GPU и памяти, а также токены в секунду на языковых моделях.

Внутри сборки: водоблок процессора, трубки контура, модули памяти и контроллер охлаждающей жидкости в сборке WS.COMPUTER

Предыдущие работы

Прототип, 2017

11 GPU с водяным охлаждением в одном корпусе

Двухпроцессорная серверная платформа в одном корпусе, спроектированном в CAD, с одним водяным контуром.

Работы для NVIDIA

Системы для вычислений ИИ и визуального производства

Работы для NVIDIA в области систем ИИ, рендеринга и визуализации. Клиенты WS.COMPUTER находятся более чем в 30 странах.

С 2011 года

Сборки с несколькими GPU

Машины на нескольких поколениях GPU, каждая под свою задачу.

Вопросы о станциях для ИИ

Как подобрать машину для локального инференса LLM?

Исходя из моделей, которые вы запускаете. Число параметров, квантизация, длина контекста и размер батча определяют необходимый объём VRAM и пропускную способность памяти. Это первый вопрос на консультации.

Воздушное или водяное охлаждение для машины для обучения моделей?

Зависит от длительного энергопотребления и целевого уровня шума. Две GPU часто можно охлаждать воздухом. Четыре и более GPU под постоянной нагрузкой обычно требуют заказного водяного контура.

Осуществляете ли вы поставку и ввод в эксплуатацию за пределами Польши?

Да. Машины поставляются по всему ЕС и миру в специальной транспортной упаковке. Удалённый ввод в эксплуатацию в вашей среде входит в каждую поставку.

Запросить консультацию

Опишите модели, данные и место, где будет работать машина.

Или напишите на info@gruency.com  ·  Сконфигурировать на WS.COMPUTER