Supermicro SYS-420GP-TNAR: GPU-сервер 4U с 8× NVIDIA A100 SXM 40GB

Supermicro SYS-420GP-TNAR: восемь A100 в одном узле

Supermicro SYS-420GP-TNAR — это GPU-сервер в корпусе 4U на базе платформы NVIDIA HGX A100 8-GPU. В узле установлены восемь ускорителей A100 SXM по 40 ГБ памяти HBM2, а суммарный объём видеопамяти составляет 320 ГБ. Такая конфигурация рассчитана на плотные вычислительные нагрузки: обучение и дообучение нейросетей, продакшн-инференс, RAG-системы и научные расчёты.

Ускорители связаны через NVLink с NVSwitch, что даёт стабильную связанность в задачах, где модель или батч распределяются на несколько GPU. За вычисления на CPU отвечают два процессора Intel Xeon Scalable 3-го поколения. Для очень крупных моделей и длинных контекстов распределение по GPU и запас под KV-cache нужно планировать заранее.

Ключевые особенности

  • 8× NVIDIA A100 SXM 40GB HBM2, 320 ГБ VRAM в сумме.
  • NVLink с NVSwitch для связи между ускорителями.
  • Tensor Cores с поддержкой TF32, BF16, FP16 и INT8 для смешанной точности.
  • Два сокета Socket P+ (LGA-4189) под Intel Xeon Scalable 3-го поколения.
  • До 32 модулей DDR4 ECC 3200 MT/s, объём памяти до 8 ТБ; заявлена поддержка Intel Optane Persistent Memory 200 до 8 ТБ, суммарно до 12 ТБ с DRAM.
  • 6 фронтальных отсеков 2.5" hot-swap под NVMe, SATA или SAS плюс два M.2 NVMe/SATA, предназначенных только для загрузки.
  • Суммарная пиковая производительность восьми GPU: BF16/FP16 Tensor Core — 4 992 TFLOPS, TF32 — 2 496 TFLOPS, INT8 — 9 984 TOPS, FP64 Tensor Core — 156 TFLOPS.

Характеристики

Параметр Значение
Форм-фактор 4U
Видеокарты 8× NVIDIA A100 SXM 40GB, HBM2
Общий объём VRAM 320 ГБ
Процессоры 2× Intel Xeon Scalable 3-го поколения, Socket P+ (LGA-4189)
Оперативная память DDR4 ECC REG, до 8 ТБ (в конфигурации — 8192 ГБ)
Накопители 6× 2.5" hot-swap NVMe/SATA/SAS, 2× M.2 NVMe/SATA (boot only)
Межсоединение GPU NVLink с NVSwitch
Состояние Новое

Для каких задач подходит

Сервер ориентирован на следующие сценарии:

  • обучение и дообучение моделей, где важны плотность ускорителей и масштабирование на несколько GPU;
  • инференс LLM: например, модели класса 70B в FP16 удобно размещать на 2–4 GPU, оставляя запас VRAM под KV-cache; для gpt-oss:120b (около 260 ГБ) и MiMo-V2.5 (около 316 ГБ) потребуется 4–8 GPU;
  • квантизированные версии крупных моделей, такие как Qwen3.5-397B-A17B в Q4_K_M (около 241 ГБ) и GLM-4.7 в Q4_K_M (около 216 ГБ);
  • генерация изображений и видео: Stable Diffusion XL, Flux.2-dev, SD Turbo, Kandinsky-5.0 — задачи легко распараллеливаются на 8 GPU;
  • RAG-системы, анализ данных и HPC-расчёты.

Поставка, проверка и гарантия

Сервер поставляется в состоянии «Новое». Перед отправкой «СервакМастер» тестирует оборудование, на конфигурацию действует гарантия 1 год с заменой компонентов. Доставка по России осуществляется СДЭК и другими ведущими службами. Если нужна конфигурация на этой платформе под ваши задачи и бюджет, свяжитесь с менеджером — мы подберём подходящий вариант.

Характеристики

ТипНовые
Основная задачаОбучение моделей / Инференс / Дообучение моделей / RAG-системы / Анализ данных / Научные расчеты (HPC)
Процессор (CPU)Intel Xeon
Видеокарта (GPU)NVIDIA A100
Количество GPU, шт8
Общий объем видеопамяти (VRAM), ГБ320
Тип памяти GPUHBM2
Объем оперативной памяти (RAM), ГБ8192
Тип оперативной памятиDDR4 ECC REG
Форм-фактор4U
16 991 100 руб.
Под заказ
Задать вопрос
Гарантия с заменой компонентов
Доставка СДЭК и ведущими службами доставки
Помощь в подборе конфигурации
Характеристики
ТипНовые
Основная задачаОбучение моделей / Инференс / Дообучение моделей / RAG-системы / Анализ данных / Научные расчеты (HPC)
Процессор (CPU)Intel Xeon
Видеокарта (GPU)NVIDIA A100
Количество GPU, шт8
Общий объем видеопамяти (VRAM), ГБ320
Тип памяти GPUHBM2
Объем оперативной памяти (RAM), ГБ8192
Тип оперативной памятиDDR4 ECC REG
Форм-фактор4U

Есть вопросы?

Поможем выбрать, проконсультируем по всем услугам, расскажем о средствах решения ваших задач
Заказать консультацию