Supermicro SYS-821GE-TNHR: GPU-сервер 8U с 8× NVIDIA H200 SXM 141GB, 2× Xeon Platinum 8558, 2 ТБ DDR5

Обзор платформы Supermicro SYS-821GE-TNHR

Supermicro SYS-821GE-TNHR — восьмиюнитовый GPU-сервер на базе HGX H200 с восемью ускорителями NVIDIA H200 в форм-факторе SXM. Суммарно система несёт 1128 ГБ видеопамяти HBM3e (8×141 ГБ), а GPU объединены через NVLink и NVSwitch, что важно для распределённого обучения и тяжёлого инференса.

В конфигурации два процессора Intel Xeon Platinum 8558 и 2 ТБ оперативной памяти DDR5 ECC RDIMM. Платформа рассчитана на задачи, где модель не помещается в один ускоритель и требуется быстрый обмен данными между GPU.

Ключевые особенности

  • 8× NVIDIA H200 SXM 141 ГБ на архитектуре Hopper с поддержкой FP16, FP8 и INT8.
  • Связка NVLink + NVSwitch для масштабирования обучения и inference с длинным контекстом на нескольких GPU.
  • Платформа поддерживает два сокета LGA-4677 и процессоры Intel Xeon Scalable 4-го и 5-го поколений (до 350 Вт TDP при воздушном охлаждении).
  • 32 слота DIMM, до 8 ТБ ECC DDR5 RDIMM (до 5600 MT/s); в данной сборке установлено 32×64 ГБ.
  • Фронтальные hot-swap отсеки 2,5": по умолчанию 12× NVMe и 3× SATA, опционально ещё 4× NVMe.
  • Два слота M.2 NVMe (M-key) предназначены только под загрузочные диски; расширение NVMe-отсеков может потребовать дополнительных контроллеров и кабелей.
  • Сетевая подсистема: 8 портов 400GbE OSFP.

Характеристики

Параметр Значение
Состояние Новое
Форм-фактор 8U
Графические ускорители 8× NVIDIA H200 SXM 141 ГБ HBM3e
Общий объём VRAM 1128 ГБ
Процессор 2× Intel Xeon Platinum 8558 (48c/96t, 2,1–4 ГГц, 330 Вт)
Оперативная память 32× 64 ГБ DDR5 ECC RDIMM (2 ТБ)
Накопители 2× M.2 960 ГБ NVMe, 4× U.2 3,84 ТБ NVMe
Сеть 8 портов 400GbE OSFP

Для каких задач подходит

Сервер ориентирован на обучение и дообучение больших языковых моделей, развёртывание инференса, RAG-системы и научные расчёты HPC. По совокупной мощности восьми H200 заявлено 31 664 TFLOPS в FP8 Tensor Core и 15 832 TFLOPS в BF16/FP16.

По оценкам для этой конфигурации, 8 GPU позволяют запускать без квантизации крупные модели: например, Qwen3.5-397B-A17B требует примерно 807 ГБ VRAM, а GLM-5.2-FP8 — около 756 ГБ. Модель класса gpt-oss:120b (примерно 196 ГБ) занимает лишь часть ресурсов, и обычно хватает 2–4 GPU с запасом под KV-cache. Для генерации изображений платформа тоже подходит: Stable Diffusion XL и Flux.2-dev (около 178 ГБ VRAM) распределяются по нескольким GPU.

Состояние, проверка и поставка

Оборудование поставляется новым. Перед отправкой «СервакМастер» тестирует сервер, на него действует гарантия 1 год с заменой компонентов, доставка по России осуществляется СДЭК и другими ведущими службами. Если нужна конфигурация под ваши задачи и бюджет, свяжитесь с менеджером — он подберёт подходящий вариант на этой платформе.

Характеристики

ТипНовые
Основная задачаОбучение моделей / Инференс / Дообучение моделей / RAG-системы / Анализ данных / Научные расчеты (HPC)
Процессор (CPU)Intel Xeon
Видеокарта (GPU)NVIDIA H200
Количество GPU, шт8
Общий объем видеопамяти (VRAM), ГБ1128
Тип памяти GPUHBM3e
Объем оперативной памяти (RAM), ГБ2048
Тип оперативной памятиDDR5 ECC REG
Форм-фактор8U
99 870 800 руб.
Под заказ
Задать вопрос
Гарантия с заменой компонентов
Доставка СДЭК и ведущими службами доставки
Помощь в подборе конфигурации
Характеристики
ТипНовые
Основная задачаОбучение моделей / Инференс / Дообучение моделей / RAG-системы / Анализ данных / Научные расчеты (HPC)
Процессор (CPU)Intel Xeon
Видеокарта (GPU)NVIDIA H200
Количество GPU, шт8
Общий объем видеопамяти (VRAM), ГБ1128
Тип памяти GPUHBM3e
Объем оперативной памяти (RAM), ГБ2048
Тип оперативной памятиDDR5 ECC REG
Форм-фактор8U

Есть вопросы?

Поможем выбрать, проконсультируем по всем услугам, расскажем о средствах решения ваших задач
Заказать консультацию