Supermicro SYS-420GP-TNAR: GPU-сервер 4U с 8× NVIDIA A100 SXM 40GB
Supermicro SYS-420GP-TNAR: восемь A100 в одном узле
Supermicro SYS-420GP-TNAR — это GPU-сервер в корпусе 4U на базе платформы NVIDIA HGX A100 8-GPU. В узле установлены восемь ускорителей A100 SXM по 40 ГБ памяти HBM2, а суммарный объём видеопамяти составляет 320 ГБ. Такая конфигурация рассчитана на плотные вычислительные нагрузки: обучение и дообучение нейросетей, продакшн-инференс, RAG-системы и научные расчёты.
Ускорители связаны через NVLink с NVSwitch, что даёт стабильную связанность в задачах, где модель или батч распределяются на несколько GPU. За вычисления на CPU отвечают два процессора Intel Xeon Scalable 3-го поколения. Для очень крупных моделей и длинных контекстов распределение по GPU и запас под KV-cache нужно планировать заранее.
Ключевые особенности
- 8× NVIDIA A100 SXM 40GB HBM2, 320 ГБ VRAM в сумме.
- NVLink с NVSwitch для связи между ускорителями.
- Tensor Cores с поддержкой TF32, BF16, FP16 и INT8 для смешанной точности.
- Два сокета Socket P+ (LGA-4189) под Intel Xeon Scalable 3-го поколения.
- До 32 модулей DDR4 ECC 3200 MT/s, объём памяти до 8 ТБ; заявлена поддержка Intel Optane Persistent Memory 200 до 8 ТБ, суммарно до 12 ТБ с DRAM.
- 6 фронтальных отсеков 2.5" hot-swap под NVMe, SATA или SAS плюс два M.2 NVMe/SATA, предназначенных только для загрузки.
- Суммарная пиковая производительность восьми GPU: BF16/FP16 Tensor Core — 4 992 TFLOPS, TF32 — 2 496 TFLOPS, INT8 — 9 984 TOPS, FP64 Tensor Core — 156 TFLOPS.
Характеристики
| Параметр | Значение |
|---|---|
| Форм-фактор | 4U |
| Видеокарты | 8× NVIDIA A100 SXM 40GB, HBM2 |
| Общий объём VRAM | 320 ГБ |
| Процессоры | 2× Intel Xeon Scalable 3-го поколения, Socket P+ (LGA-4189) |
| Оперативная память | DDR4 ECC REG, до 8 ТБ (в конфигурации — 8192 ГБ) |
| Накопители | 6× 2.5" hot-swap NVMe/SATA/SAS, 2× M.2 NVMe/SATA (boot only) |
| Межсоединение GPU | NVLink с NVSwitch |
| Состояние | Новое |
Для каких задач подходит
Сервер ориентирован на следующие сценарии:
- обучение и дообучение моделей, где важны плотность ускорителей и масштабирование на несколько GPU;
- инференс LLM: например, модели класса 70B в FP16 удобно размещать на 2–4 GPU, оставляя запас VRAM под KV-cache; для gpt-oss:120b (около 260 ГБ) и MiMo-V2.5 (около 316 ГБ) потребуется 4–8 GPU;
- квантизированные версии крупных моделей, такие как Qwen3.5-397B-A17B в Q4_K_M (около 241 ГБ) и GLM-4.7 в Q4_K_M (около 216 ГБ);
- генерация изображений и видео: Stable Diffusion XL, Flux.2-dev, SD Turbo, Kandinsky-5.0 — задачи легко распараллеливаются на 8 GPU;
- RAG-системы, анализ данных и HPC-расчёты.
Поставка, проверка и гарантия
Сервер поставляется в состоянии «Новое». Перед отправкой «СервакМастер» тестирует оборудование, на конфигурацию действует гарантия 1 год с заменой компонентов. Доставка по России осуществляется СДЭК и другими ведущими службами. Если нужна конфигурация на этой платформе под ваши задачи и бюджет, свяжитесь с менеджером — мы подберём подходящий вариант.
Характеристики
| Тип | Новые |
| Основная задача | Обучение моделей / Инференс / Дообучение моделей / RAG-системы / Анализ данных / Научные расчеты (HPC) |
| Процессор (CPU) | Intel Xeon |
| Видеокарта (GPU) | NVIDIA A100 |
| Количество GPU, шт | 8 |
| Общий объем видеопамяти (VRAM), ГБ | 320 |
| Тип памяти GPU | HBM2 |
| Объем оперативной памяти (RAM), ГБ | 8192 |
| Тип оперативной памяти | DDR4 ECC REG |
| Форм-фактор | 4U |









