ASRock Rack 6U8X-EGS2 H100: GPU-сервер 6U на 8× NVIDIA H100 SXM 80GB
ASRock Rack 6U8X-EGS2 H100: восьмиграфический узел для больших ИИ-нагрузок
ASRock Rack 6U8X-EGS2 — это GPU-сервер высотой 6U, построенный на платформе NVIDIA HGX H100 с восемью ускорителями и коммутатором NVSwitch. В данной сборке установлены 8× H100 SXM 80GB, суммарно 640 ГБ памяти HBM3. Плотная связность ускорителей внутри HGX делает машину удобной для задач, где модель или поток запросов не помещаются на одну-две карты.
Узел рассчитан на обучение и дообучение моделей, инференс в продакшне, RAG-системы и научные расчёты (HPC). Большой объём видеопамяти позволяет держать крупные батчи и длинный контекст, а поддержка FP16, FP8 и INT8 помогает масштабировать и обучение, и обслуживание моделей.
Ключевые особенности
- 8× NVIDIA H100 SXM 80GB на базе HGX с NVSwitch — 640 ГБ HBM3 на узел.
- Два процессора Intel Xeon Scalable 4-го и 5-го поколений в сокетах LGA 4677.
- 32 слота DIMM (16+16, 2DPC) под DDR5 RDIMM и RDIMM-3DS, оперативная память до 8 ТБ.
- Накопители: 8 hot-swap 2.5" NVMe (PCIe 5.0 x4) и 4 hot-swap 2.5" NVMe (PCIe 5.0 x4) или SATA, плюс 2 слота M.2 (PCIe 3.0 x4, один также поддерживает SATA 6Gb/s).
- Совокупная производительность восьми GPU: FP8 Tensor Core — 31 664 TFLOPS, BF16/FP16 — 15 832 TFLOPS, TF32 — 7 912 TFLOPS, FP64 Tensor Core — 536 TFLOPS, INT8 — 31 664 TOPS.
- Запас под крупные LLM: по расчётам поставщика, на узле можно запускать DeepSeek-R1-GGUF 685B (Q4_K_M, около 404 ГБ), Qwen3.5-397B-A17B-FP8 (около 406 ГБ), Mistral-Large-3-675B в Q4_K_M (около 407 ГБ) и другие модели; для длинного контекста стоит оставлять запас VRAM под KV-cache.
Характеристики
| Параметр | Значение |
|---|---|
| Состояние | Новое |
| Форм-фактор | 6U |
| Видеокарты | 8× NVIDIA H100 SXM 80GB HBM3 |
| Количество GPU | 8 |
| Общий объём видеопамяти | 640 ГБ |
| Процессор | 2× Intel Xeon Scalable 4-го и 5-го поколений, LGA 4677 |
| Оперативная память | до 8 ТБ DDR5 ECC RDIMM, 32 слота DIMM |
| Накопители | 8× NVMe 2.5" PCIe 5.0 x4, ещё 4× NVMe 2.5" PCIe 5.0 x4 или SATA, 2× M.2 |
| Основные задачи | Обучение, дообучение, инференс, RAG, анализ данных, HPC |
Для каких задач подходит
- Обучение и дообучение моделей — восемь связанных через NVSwitch GPU с общим пулом 640 ГБ HBM3.
- Инференс LLM в продакшне — высокий throughput при распределении модели по 4–8 GPU; для предсказуемой нагрузки разумно ограничивать контекст и размер батча, чтобы сохранять запас под KV-cache.
- RAG-системы и агентные сценарии — крупные модели вместе с векторным поиском на одном узле.
- Генерация изображений и видео — Stable Diffusion XL, SD Turbo, Kandinsky 5.0 позволяют запускать параллельные пайплайны по разным GPU; Flux.2-dev обычно требует multi-GPU режима или оптимизации памяти.
- HPC и научные расчёты — задачи, использующие FP64 Tensor Core и быструю связь между ускорителями.
Состояние, проверка и поставка
Сервер поставляется новым. Перед отправкой «СервакМастер» тестирует оборудование, на него действует гарантия 1 год с заменой компонентов. Доставка выполняется по России через СДЭК и другие ведущие службы. Если нужна конфигурация на эту платформу под ваши задачи, свяжитесь с менеджером — мы предложим вариант под бюджет и требования.
Характеристики
| Тип | Новые |
| Основная задача | Обучение моделей / Инференс / Дообучение моделей / RAG-системы / Анализ данных / Научные расчеты (HPC) |
| Процессор (CPU) | Intel Xeon |
| Видеокарта (GPU) | NVIDIA H100 |
| Количество GPU, шт | 8 |
| Общий объем видеопамяти (VRAM), ГБ | 640 |
| Тип памяти GPU | HBM3 |
| Объем оперативной памяти (RAM), ГБ | 8192 |
| Тип оперативной памяти | DDR5 ECC REG |
| Форм-фактор | 6U |











