Сервер HPE Cray XD670 Gen11 с 8× NVIDIA H200 SXM 141GB для ИИ и HPC
Платформа для больших моделей на восьми H200
HPE Cray XD670 Gen11 в этой конфигурации построен на NVIDIA HGX H200 с восемью ускорителями в формате SXM5. Это одноузловая платформа для плотных multi-GPU нагрузок: обучения, дообучения и промышленного инференса языковых моделей, а также научных расчётов.
Каждый ускоритель H200 на архитектуре Hopper несёт 141 ГБ памяти HBM3e, вместе это 1128 ГБ (около 1,1 ТБ). Такой запас упрощает распределённый запуск крупных моделей и позволяет держать KV-кэш при длинном контексте и высоком параллелизме запросов. Платформа поддерживает вычисления FP16, FP8 и INT8.
Ключевые особенности
- 8 GPU NVIDIA H200 SXM, суммарно 1128 ГБ видеопамяти HBM3e.
- Два процессора Intel Xeon Scalable 5-го поколения (Emerald Rapids).
- До 32 слотов DDR5 и объём оперативной памяти до 4 ТБ, скорость модулей до 5600 MT/s.
- Накопители: до 8 SFF NVMe U.2/U.3 и 2 M.2 RAID SSD (Read-Intensive и Mixed-Use).
- Воздушное исполнение или вариант с прямым жидкостным охлаждением (DLC) для большей плотности и энергоэффективности в стойке.
- Совокупная пиковая мощность восьми H200 по спецификации: FP8 Tensor Core 31 664 TFLOPS, BF16/FP16 15 832 TFLOPS, TF32 7 912 TFLOPS, FP64 Tensor Core 536 TFLOPS.
Характеристики
| Параметр | Значение |
|---|---|
| Состояние | Новое |
| Графические ускорители | 8× NVIDIA H200 SXM |
| Общий объём VRAM | 1128 ГБ |
| Тип памяти GPU | HBM3e |
| Процессор | Intel Xeon (2× Scalable 5-го поколения) |
| Оперативная память | 4096 ГБ, DDR5 ECC REG |
| Слоты памяти | 32 DIMM |
| Накопители | до 8× NVMe U.2/U.3 и 2× M.2 RAID |
| Форм-фактор | 6U |
| Охлаждение | воздушное или DLC |
Для каких задач подходит
- Обучение и дообучение больших языковых моделей на нескольких GPU.
- Промышленный инференс с длинным контекстом и большим числом одновременных запросов.
- RAG-системы и агентные сценарии на крупных моделях без агрессивной квантизации.
- Генерация изображений и видео: Stable Diffusion XL, Flux.2-dev, Kandinsky 5.0, причём запросы удобно распараллеливать по GPU.
- Научные и инженерные расчёты HPC и анализ данных.
По оценкам поставщика, объёма памяти достаточно для запуска в распределённом режиме таких моделей, как DeepSeek-V4-Pro (около 865 ГБ), Qwen3.5-397B-A17B (около 807 ГБ) и GLM-5.2-FP8 (около 756 ГБ). Для длинного контекста стоит оставлять запас VRAM под KV-кэш.
Состояние, проверка и поставка
Сервер поставляется новым. Перед отправкой «СервакМастер» тестирует оборудование, на него действует гарантия 1 год с заменой компонентов. Доставка по России выполняется через СДЭК и другие ведущие службы. Если нужна конфигурация под ваши задачи и бюджет, свяжитесь с менеджером, и мы подберём подходящий вариант на этой платформе.
Характеристики
| Тип | Новые |
| Основная задача | Обучение моделей / Инференс / Дообучение моделей / RAG-системы / Анализ данных / Научные расчеты (HPC) |
| Процессор (CPU) | Intel Xeon |
| Видеокарта (GPU) | NVIDIA H200 |
| Количество GPU, шт | 8 |
| Общий объем видеопамяти (VRAM), ГБ | 1128 |
| Тип памяти GPU | HBM3e |
| Объем оперативной памяти (RAM), ГБ | 4096 |
| Тип оперативной памяти | DDR5 ECC REG |
| Форм-фактор | 6U |





