GPU-сервер ASRock Rack 6U8X-EGS2 H200 — 8× NVIDIA H200 SXM 141GB, 6U
ASRock Rack 6U8X-EGS2 H200 — платформа на 8 GPU для больших языковых моделей
ASRock Rack 6U8X-EGS2 — это двухсокетный сервер в корпусе 6U, построенный вокруг платы NVIDIA HGX H200 с восемью ускорителями H200 SXM и коммутацией NVSwitch. Каждый ускоритель несёт 141 ГБ памяти HBM3e, поэтому суммарно узел располагает 1128 ГБ видеопамяти — этого достаточно, чтобы держать крупные модели без агрессивной квантизации.
Такая конфигурация рассчитана на промышленный инференс с высоким QPS и длинным контекстом, на обучение и дообучение моделей с масштабированием на все восемь GPU, а также на HPC-расчёты, где важна плотность ускорителей и быстрый обмен данными между ними.
Ключевые особенности
- 8× NVIDIA H200 SXM по 141 ГБ HBM3e, итого 1128 ГБ VRAM (около 1,1 ТБ).
- NVSwitch на плате HGX: быстрая связь между всеми GPU внутри узла.
- Два сокета Intel Xeon Scalable 4-го и 5-го поколений (Dual Socket E, LGA 4677).
- 32 слота DIMM (16+16, 2DPC) под DDR5 RDIMM и RDIMM-3DS, до 8 ТБ оперативной памяти.
- 8 hot-swap накопителей 2.5" NVMe (PCIe 5.0 x4) плюс ещё 4 hot-swap 2.5" отсека под NVMe (PCIe 5.0 x4) или SATA.
- Два слота M.2 (PCIe 3.0 x4), один из них также поддерживает SATA 6 Гбит/с.
- Совокупная производительность восьми H200 по Tensor Core: FP8 — 31 664 TFLOPS, BF16/FP16 — 15 832 TFLOPS, TF32 — 7 912 TFLOPS, FP64 — 536 TFLOPS.
Характеристики
| Параметр | Значение |
|---|---|
| Форм-фактор | 6U |
| Графические ускорители | 8× NVIDIA H200 SXM |
| Память GPU | 141 ГБ HBM3e на ускоритель |
| Общий объём VRAM | 1128 ГБ |
| Процессоры | 2× Intel Xeon Scalable 4-го и 5-го поколений, LGA 4677 |
| Оперативная память | DDR5 ECC RDIMM / RDIMM-3DS, 32 слота, до 8 ТБ |
| Накопители | 8× 2.5" NVMe PCIe 5.0 x4 + 4× 2.5" NVMe PCIe 5.0 x4 или SATA, hot-swap |
| Слоты M.2 | 2 (PCIe 3.0 x4) |
| Состояние | Новое |
Для каких задач подходит
- Инференс и RAG-системы. Большой запас VRAM позволяет увеличивать батчи, держать много активных сессий и не урезать контекст из-за KV-cache.
- Обучение и дообучение. Восемь GPU, объединённые NVSwitch, масштабируются на один узел без внешних межсерверных связей.
- Крупные LLM. По оценкам в исходном описании, на узле помещаются, например, DeepSeek-V4-Pro (около 865 ГБ), Mistral-Large-3-675B (680–750 ГБ), GLM-5.2-FP8 (около 756 ГБ) и gpt-oss:120b (около 196 ГБ) — последнюю удобно запускать на одном-двух GPU несколькими инстансами.
- Диффузионные модели. Stable Diffusion XL, Flux.2-dev, Kandinsky 5.0 — высокие разрешения и параллельная пакетная генерация по нескольким GPU.
- HPC и научные расчёты. Высокая плотность ускорителей и быстрая связь между ними.
Состояние, проверка и поставка
Сервер поставляется новым. Перед отправкой «СервакМастер» тестирует оборудование, на него действует гарантия 1 год с заменой компонентов. Доставка по России осуществляется СДЭК и другими ведущими службами. Если нужна конфигурация на эту платформу под ваши задачи и бюджет, свяжитесь с менеджером — мы подберём подходящий вариант.
Характеристики
| Тип | Новые |
| Основная задача | Обучение моделей / Инференс / Дообучение моделей / RAG-системы / Анализ данных / Научные расчеты (HPC) |
| Процессор (CPU) | Intel Xeon |
| Видеокарта (GPU) | NVIDIA H200 |
| Количество GPU, шт | 8 |
| Общий объем видеопамяти (VRAM), ГБ | 1128 |
| Тип памяти GPU | HBM3e |
| Объем оперативной памяти (RAM), ГБ | 8192 |
| Тип оперативной памяти | DDR5 ECC REG |
| Форм-фактор | 6U |











