Supermicro SYS-422GL-NR с 8× NVIDIA H200 NVL 141GB — GPU-сервер 4U

Supermicro SYS-422GL-NR с восемью NVIDIA H200 NVL: сервер для крупных ИИ-нагрузок

Supermicro SYS-422GL-NR — это 4U-платформа для плотной установки ускорителей: в корпус помещается до восьми двухслотовых GPU, которые подключены по схеме PCIe 5.0 x16 Switch Dual-Root. В данной конфигурации установлены восемь NVIDIA H200 NVL по 141 ГБ HBM3e, то есть в одном узле доступно 1128 ГБ видеопамяти.

Главное преимущество сборки — именно объём и скорость GPU-памяти: 4,8 ТБ/с на карту позволяют держать в памяти крупные языковые модели, длинный контекст и KV-cache без жёсткой экономии и агрессивной квантизации. Это решение для компаний, которым нужен мощный inference-узел или платформа для смешанных ИИ- и HPC-задач.

Ключевые особенности

  • 8× NVIDIA H200 NVL, по 141 ГБ HBM3e на ускоритель и 1128 ГБ суммарно.
  • Пропускная способность памяти GPU — 4,8 ТБ/с; до 3341 TFLOPS в FP8 и 1671 TFLOPS в FP16/BF16 на одну карту.
  • Два процессора Intel Xeon серии 6900 с P-ядрами (сокет LGA-7529).
  • До 24 модулей DDR5 ECC REG и до 6 ТБ оперативной памяти.
  • 8 фронтальных hot-swap накопителей E1.S NVMe и 2 слота M.2 PCIe 4.0 x4 NVMe (M-key 2280).
  • Четыре резервируемых блока питания по 3200 Вт уровня Titanium.

Характеристики

Параметр Значение
Платформа Supermicro SYS-422GL-NR
Форм-фактор 4U
Видеокарты 8× NVIDIA H200 NVL
Видеопамять 1128 ГБ HBM3e (141 ГБ на GPU)
Процессор 2× Intel Xeon серии 6900 с P-ядрами
Оперативная память 24 DIMM, до 6 ТБ DDR5 ECC REG
Накопители 8× E1.S NVMe, 2× M.2 PCIe 4.0 x4 NVMe
Питание 4× 3200 Вт Titanium, резервирование
Состояние Новое

Совокупная мощность восьми H200 по типам точности: FP64 Tensor Core — 480 TFLOPS, TF32 — 6680 TFLOPS, BF16/FP16 — 13368 TFLOPS, FP8 и INT8 — 26728 TFLOPS (TOPS).

Для каких задач подходит

  • Инференс больших LLM на одном узле: по оценкам поставщика, с запасом помещаются модели с требованиями к памяти порядка 600–1000 ГБ, например DeepSeek-V4-Pro (около 865 ГБ) или Mistral-Large-3-675B (около 682 ГБ).
  • Одновременный запуск нескольких сервисов и крупные batch-нагрузки на более лёгких моделях, таких как gpt-oss-120b (около 196 ГБ) и gemma-4-31B-it (около 62,6 ГБ).
  • RAG-системы, агентные сценарии, дообучение моделей и анализ данных.
  • Генерация изображений и видео: Stable Diffusion XL, FLUX.2-dev, Kandinsky 5.0 с большим запасом под разрешение и очередь задач.
  • Научные расчёты и смешанные ИИ/HPC-нагрузки.

Состояние, проверка и поставка

Сервер поставляется новым. Перед отправкой оборудование тестируется, на него действует гарантия 1 год с заменой компонентов. «СервакМастер» организует доставку по России через СДЭК и другие ведущие службы; подобрать конфигурацию под вашу задачу и уточнить детали поставки можно у менеджеров магазина.

Характеристики

ТипНовые
Основная задачаОбучение моделей / Инференс / Дообучение моделей / RAG-системы / Анализ данных / Научные расчеты (HPC)
Процессор (CPU)Intel Xeon 6-series
Видеокарта (GPU)NVIDIA H200
Количество GPU, шт8
Общий объем видеопамяти (VRAM), ГБ1128
Тип памяти GPUHBM3e
Объем оперативной памяти (RAM), ГБ6144
Тип оперативной памятиDDR5 ECC REG
Форм-фактор4U
75 617 600 руб.
Под заказ
Задать вопрос
Гарантия с заменой компонентов
Доставка СДЭК и ведущими службами доставки
Помощь в подборе конфигурации
Характеристики
ТипНовые
Основная задачаОбучение моделей / Инференс / Дообучение моделей / RAG-системы / Анализ данных / Научные расчеты (HPC)
Процессор (CPU)Intel Xeon 6-series
Видеокарта (GPU)NVIDIA H200
Количество GPU, шт8
Общий объем видеопамяти (VRAM), ГБ1128
Тип памяти GPUHBM3e
Объем оперативной памяти (RAM), ГБ6144
Тип оперативной памятиDDR5 ECC REG
Форм-фактор4U

Есть вопросы?

Поможем выбрать, проконсультируем по всем услугам, расскажем о средствах решения ваших задач
Заказать консультацию