Серверы для инференса GigaChat 3.1 — готовые конфигурации с NVIDIA H100 и A100 в СервакМастер

AI-серверы под GigaChat 3.1: подбор и продажа в СервакМастер

В каталоге «СервакМастер» собраны серверные решения и GPU-системы, рассчитанные на развёртывание и промышленную эксплуатацию языковой модели GigaChat 3.1. Каждая конфигурация отбирается с расчётом на реальные нагрузки инференса: пропускную способность GPU-памяти, задержки межузлового взаимодействия и требования к непрерывной работе 24/7.

Чем GigaChat 3.1 отличается от типовых серверных задач

GigaChat 3.1 — крупная языковая модель (LLM) с десятками миллиардов параметров. В отличие от классических вычислительных задач, инференс LLM предъявляет специфические аппаратные требования:

  • Вместимость GPU-памяти. Квантованная INT8-версия модели занимает от 40 до 80 ГБ; FP16-версия — вдвое больше. Без достаточного объёма HBM модель выгружается на CPU, что катастрофически снижает скорость.
  • Пропускная способность HBM. Скорость генерации токенов определяется не тактовой частотой GPU, а скоростью чтения весов из памяти. NVIDIA H100 SXM5 обеспечивает 3,35 ТБ/с — именно это делает его стандартом для LLM-инференса.
  • Межузловые интерконнекты. При тензорном параллелизме между несколькими GPU или узлами задержки на шине определяют суммарную производительность. InfiniBand NDR 400 Гб/с снижает их в 5–8 раз по сравнению с обычным Ethernet.
  • Тепловой пакет и охлаждение. Один H100 SXM5 рассеивает до 700 Вт. Восемь карт в одном шасси требуют прямого жидкостного охлаждения или высокоэффективной принудительной вентиляции.

Готовые конфигурации

Начальный уровень — одиночный узел

Подходит для тестирования, пилотных проектов и небольших нагрузок:

  • Процессор: AMD EPYC 9354 (32 ядра, 3,25 / 3,8 ГГц) или Intel Xeon Gold 6448Y
  • GPU: 1–2 × NVIDIA A100 80 ГБ или H100 80 ГБ SXM5
  • ОЗУ: от 512 ГБ DDR5 ECC RDIMM
  • Хранилище: 2 × NVMe SSD 3,84 ТБ в RAID 1
  • Сеть: 2 × 25GbE + опциональный порт InfiniBand HDR 200 Гб/с

Рабочий уровень — кластер из 2–4 узлов

Производственная производительность с запасом для роста нагрузки:

  • Платформа: Supermicro SYS-420GP-TNR или ASUS ESC N8-E11
  • Процессор: 2 × AMD EPYC 9554 (64 ядра, 3,1 / 3,75 ГГц)
  • GPU: 8 × NVIDIA H100 80 ГБ SXM5 с NVLink 4.0
  • ОЗУ: 2 ТБ DDR5-4800 ECC RDIMM (32 слота)
  • Хранилище: 4 × NVMe U.2 7,68 ТБ + внешний Ceph-кластер
  • Сеть: 2 × 100GbE + 8 × InfiniBand NDR 400 Гб/с (через ConnectX-7)

Флагманский уровень — DGX-класс

Для высоконагруженного продакшна и мультитенантных сред:

  • Платформа: NVIDIA DGX H100 или Dell PowerEdge XE9680
  • GPU: 8 × NVIDIA H100 80 ГБ SXM5, суммарно 640 ГБ HBM3
  • Процессор: 2 × Intel Xeon Platinum 8480+ (60 ядер, 2,0 / 3,8 ГГц)
  • ОЗУ: 2 ТБ DDR5-4800 ECC
  • Хранилище: 8 × NVMe SSD 3,84 ТБ (NVMe RAID)
  • Сеть: ConnectX-7 InfiniBand NDR 400 Гб/с, 2 × 10GbE для управления

Как выбрать подходящую конфигурацию

При расчёте под конкретный сценарий ориентируйтесь на следующие показатели:

Параметр На что влияет
Суммарный объём GPU-памяти Должен вмещать веса модели + KV-кэш под целевой batch size
Пропускная способность HBM Определяет скорость генерации (tokens/s)
Межузловая сеть InfiniBand NDR при тензорном параллелизме; 100GbE — минимум для конвейерного
Системная память Минимум 512 ГБ на узел; рекомендуется 1–2 ТБ
Питание и охлаждение Закладывайте 800–1000 Вт на GPU-карту с запасом 20%

Если самостоятельный расчёт затруднён — воспользуйтесь бесплатной консультацией наших инженеров через форму на сайте.

Что входит в покупку AI-сервера в СервакМастер

Помимо поставки оборудования, мы берём на себя весь цикл подготовки к запуску:

  • Техническая консультация без ограничений. Поможем подобрать конфигурацию, исходя из вашего бюджета, целевых нагрузок и плана масштабирования.
  • Предустановка программного стека. Ubuntu Server LTS, CUDA Toolkit, vLLM или Triton Inference Server — по вашему выбору.
  • Нагрузочное тестирование перед отгрузкой. Стресс-тест GPU, проверка памяти, burn-in не менее 24 часов — сервер уходит к вам уже проверенным.
  • Доставка по всей России. Надёжная упаковка, страхование груза, отслеживание на всём маршруте.
  • Гарантийное обслуживание от 12 до 36 месяцев в зависимости от производителя и конфигурации. На большинство позиций действует программа NBD — замена неисправного компонента на следующий рабочий день.
  • Постгарантийная поддержка. Аппаратный мониторинг, замена компонентов, консультации по расширению кластера.

Условия приобретения

Все позиции в каталоге поставляются с официальной гарантией производителя. Оплата по безналичному расчёту для юридических лиц, НДС включён в стоимость. Цена указана за базовую конфигурацию; итоговая стоимость зависит от выбранных компонентов, объёма заказа и условий поставки.

Для уточнения актуальной цены и наличия на складе воспользуйтесь кнопкой «Запросить цену» или свяжитесь с нами через форму обратной связи.

13 935 600 руб.
Под заказ
Задать вопрос
Гарантия с заменой компонентов
Доставка СДЭК и ведущими службами доставки
Помощь в подборе конфигурации
Характеристики
БрендNVIDIA
ПроцессорAMD EPYC
ВидеокартаNVIDIA
СостояниеНовое

Есть вопросы?

Поможем выбрать, проконсультируем по всем услугам, расскажем о средствах решения ваших задач
Заказать консультацию