Сервер HPE Cray XD670 Gen11 с 8× NVIDIA H200 SXM 141GB для ИИ и HPC

Платформа для больших моделей на восьми H200

HPE Cray XD670 Gen11 в этой конфигурации построен на NVIDIA HGX H200 с восемью ускорителями в формате SXM5. Это одноузловая платформа для плотных multi-GPU нагрузок: обучения, дообучения и промышленного инференса языковых моделей, а также научных расчётов.

Каждый ускоритель H200 на архитектуре Hopper несёт 141 ГБ памяти HBM3e, вместе это 1128 ГБ (около 1,1 ТБ). Такой запас упрощает распределённый запуск крупных моделей и позволяет держать KV-кэш при длинном контексте и высоком параллелизме запросов. Платформа поддерживает вычисления FP16, FP8 и INT8.

Ключевые особенности

  • 8 GPU NVIDIA H200 SXM, суммарно 1128 ГБ видеопамяти HBM3e.
  • Два процессора Intel Xeon Scalable 5-го поколения (Emerald Rapids).
  • До 32 слотов DDR5 и объём оперативной памяти до 4 ТБ, скорость модулей до 5600 MT/s.
  • Накопители: до 8 SFF NVMe U.2/U.3 и 2 M.2 RAID SSD (Read-Intensive и Mixed-Use).
  • Воздушное исполнение или вариант с прямым жидкостным охлаждением (DLC) для большей плотности и энергоэффективности в стойке.
  • Совокупная пиковая мощность восьми H200 по спецификации: FP8 Tensor Core 31 664 TFLOPS, BF16/FP16 15 832 TFLOPS, TF32 7 912 TFLOPS, FP64 Tensor Core 536 TFLOPS.

Характеристики

Параметр Значение
Состояние Новое
Графические ускорители 8× NVIDIA H200 SXM
Общий объём VRAM 1128 ГБ
Тип памяти GPU HBM3e
Процессор Intel Xeon (2× Scalable 5-го поколения)
Оперативная память 4096 ГБ, DDR5 ECC REG
Слоты памяти 32 DIMM
Накопители до 8× NVMe U.2/U.3 и 2× M.2 RAID
Форм-фактор 6U
Охлаждение воздушное или DLC

Для каких задач подходит

  • Обучение и дообучение больших языковых моделей на нескольких GPU.
  • Промышленный инференс с длинным контекстом и большим числом одновременных запросов.
  • RAG-системы и агентные сценарии на крупных моделях без агрессивной квантизации.
  • Генерация изображений и видео: Stable Diffusion XL, Flux.2-dev, Kandinsky 5.0, причём запросы удобно распараллеливать по GPU.
  • Научные и инженерные расчёты HPC и анализ данных.

По оценкам поставщика, объёма памяти достаточно для запуска в распределённом режиме таких моделей, как DeepSeek-V4-Pro (около 865 ГБ), Qwen3.5-397B-A17B (около 807 ГБ) и GLM-5.2-FP8 (около 756 ГБ). Для длинного контекста стоит оставлять запас VRAM под KV-кэш.

Состояние, проверка и поставка

Сервер поставляется новым. Перед отправкой «СервакМастер» тестирует оборудование, на него действует гарантия 1 год с заменой компонентов. Доставка по России выполняется через СДЭК и другие ведущие службы. Если нужна конфигурация под ваши задачи и бюджет, свяжитесь с менеджером, и мы подберём подходящий вариант на этой платформе.

Характеристики

ТипНовые
Основная задачаОбучение моделей / Инференс / Дообучение моделей / RAG-системы / Анализ данных / Научные расчеты (HPC)
Процессор (CPU)Intel Xeon
Видеокарта (GPU)NVIDIA H200
Количество GPU, шт8
Общий объем видеопамяти (VRAM), ГБ1128
Тип памяти GPUHBM3e
Объем оперативной памяти (RAM), ГБ4096
Тип оперативной памятиDDR5 ECC REG
Форм-фактор6U
86 415 550 руб.
Под заказ
Задать вопрос
Гарантия с заменой компонентов
Доставка СДЭК и ведущими службами доставки
Помощь в подборе конфигурации
Характеристики
ТипНовые
Основная задачаОбучение моделей / Инференс / Дообучение моделей / RAG-системы / Анализ данных / Научные расчеты (HPC)
Процессор (CPU)Intel Xeon
Видеокарта (GPU)NVIDIA H200
Количество GPU, шт8
Общий объем видеопамяти (VRAM), ГБ1128
Тип памяти GPUHBM3e
Объем оперативной памяти (RAM), ГБ4096
Тип оперативной памятиDDR5 ECC REG
Форм-фактор6U

Есть вопросы?

Поможем выбрать, проконсультируем по всем услугам, расскажем о средствах решения ваших задач
Заказать консультацию