GPU-сервер ASRock Rack 6U8X-TURIN2 SYN H200 с 8× NVIDIA H200 SXM 141GB
Сервер на NVIDIA HGX H200 с восемью GPU для крупных ИИ-нагрузок
ASRock Rack 6U8X-TURIN2 SYN H200 — это 6U-платформа на базе модуля NVIDIA HGX с восемью ускорителями H200 SXM по 141 ГБ памяти HBM3e. Графические процессоры объединены через NVSwitch, что обеспечивает быстрый обмен данными между картами и позволяет считать одну модель распределённо на всех восьми GPU.
Суммарный объём видеопамяти составляет 1128 ГБ (около 1,1 ТБ). Этого хватает, чтобы держать большие языковые модели без агрессивной квантизации и оставлять запас под KV-cache при длинном контексте и множестве параллельных запросов. Сервер рассчитан на обучение, дообучение, промышленный инференс, RAG-системы и научные расчёты.
Ключевые особенности
- 8× NVIDIA H200 SXM (архитектура Hopper), 141 ГБ HBM3e на каждый ускоритель, всего 1128 ГБ.
- Два процессора AMD EPYC 9005/9004 (сокет SP5, LGA6096); в описании также упомянута поддержка серии 97x4.
- 24 слота DIMM (12+12, 1DPC) под DDR5 RDIMM / RDIMM-3DS, максимальный объём — до 8 ТБ.
- Оптимизация GPU-to-CPU, GPUDirect RDMA NIC и GPUDirect Storage через PCIe-коммутатор в режиме Synthetic Mode — полезно для задач с высокой нагрузкой на ввод-вывод.
- 8 отсеков hot-swap 2.5" NVMe PCIe 5.0 x4 через PCIe Switch и ещё 4 отсека NVMe PCIe 5.0 x4 напрямую от CPU.
- Два слота M.2 (PCIe 3.0 x2/SATA и PCIe 3.0 x4/SATA), например под загрузочные накопители.
- Совокупная пиковая производительность восьми H200 по описанию: FP8 Tensor Core — 31 664 TFLOPS, BF16/FP16 Tensor Core — 15 832 TFLOPS, TF32 Tensor Core — 7 912 TFLOPS, FP64 Tensor Core — 536 TFLOPS.
Характеристики
| Параметр | Значение |
|---|---|
| Состояние | Новое |
| Форм-фактор | 6U |
| GPU | 8× NVIDIA H200 SXM 141GB |
| Тип памяти GPU | HBM3e |
| Общий объём VRAM | 1128 ГБ |
| Процессоры | 2× AMD EPYC 9005/9004 (SP5, LGA6096) |
| Оперативная память | до 8 ТБ DDR5 ECC RDIMM, 24 слота DIMM |
| Накопители NVMe | 8× 2.5" PCIe 5.0 x4 (через PCIe Switch) + 4× 2.5" PCIe 5.0 x4 (от CPU) |
| M.2 | 2 слота (PCIe 3.0 x2/SATA и PCIe 3.0 x4/SATA) |
Для каких задач подходит
Платформа ориентирована на сценарии, где важны и объём видеопамяти, и межкарточная связность:
- обучение и дообучение больших моделей с распределением по восьми GPU;
- промышленный инференс LLM с длинным контекстом и высокой параллельностью запросов;
- RAG-системы и агентные рабочие процессы;
- генерация изображений и видео на диффузионных моделях, включая параллельные очереди задач;
- HPC и научные расчёты, анализ данных.
По данным описания, сервер рассчитан на запуск крупных моделей на восьми GPU: например, ориентировочная потребность в VRAM для DeepSeek-V4-Pro составляет около 865 ГБ, для GLM-5.2-FP8 — около 756 ГБ, для Gpt-oss:120b — около 196 ГБ (обычно хватает 1–2 GPU, остальные можно отдать под параллельные инстансы). Во всех случаях стоит оставлять запас памяти под KV-cache.
Состояние, проверка и доставка
Сервер поставляется новым. «СервакМастер» тестирует оборудование перед отправкой, предоставляет гарантию 1 год с заменой компонентов и организует доставку по России через СДЭК и другие ведущие службы. Если нужна конфигурация на эту платформу под ваши задачи и бюджет, свяжитесь с менеджером — подберём подходящий вариант.
Характеристики
| Тип | Новые |
| Основная задача | Обучение моделей / Инференс / Дообучение моделей / RAG-системы / Анализ данных / Научные расчеты (HPC) |
| Процессор (CPU) | AMD EPYC |
| Видеокарта (GPU) | NVIDIA H200 |
| Количество GPU, шт | 8 |
| Общий объем видеопамяти (VRAM), ГБ | 1128 |
| Тип памяти GPU | HBM3e |
| Объем оперативной памяти (RAM), ГБ | 6144 |
| Тип оперативной памяти | DDR5 ECC REG |
| Форм-фактор | 6U |





