GPU-сервер Supermicro SYS-420GP-TNAR на 8× NVIDIA A100 SXM 80GB (640 ГБ HBM2e)
Supermicro SYS-420GP-TNAR: восемь A100 SXM в одном 4U-корпусе
SYS-420GP-TNAR — это GPU-платформа Supermicro на базе NVIDIA HGX A100 с восемью ускорителями A100 SXM по 80 ГБ. Графические процессоры объединены через NVLink и NVSwitch, поэтому внутри сервера они работают как единый вычислительный пул с быстрым обменом данными. Суммарный объём видеопамяти — 640 ГБ HBM2e.
Такая конфигурация рассчитана на задачи, где важны стабильная multi-GPU работа и масштабирование нагрузки: обучение и дообучение нейросетей, промышленный инференс больших языковых моделей, RAG-системы и научные расчёты. Хост-часть построена на двух процессорах Intel Xeon Scalable 3-го поколения и до 8 ТБ оперативной памяти.
Ключевые особенности
- Платформа HGX A100 8-GPU: восемь NVIDIA A100 SXM 80GB с памятью HBM2e и связью NVLink через NVSwitch.
- 640 ГБ суммарной VRAM (8×80 ГБ) — запас для больших батчей и длинных контекстов при грамотном контроле KV-cache.
- Два сокета Socket P+ (LGA-4189) под Intel Xeon Scalable 3-го поколения.
- 32 слота DIMM, до 8 ТБ ECC DDR4; заявлена также поддержка Intel Optane Persistent Memory 200 до 8 ТБ, всего до 12 ТБ вместе с DRAM.
- Накопители: 6× 2.5" hot-swap NVMe/SATA/SAS на фронтальной панели и 2× M.2 NVMe/SATA.
- Слоты M.2 предназначены только для загрузочных дисков, основное хранилище ставится во фронтальные отсеки.
- Форм-фактор 4U для стандартной серверной стойки.
Характеристики
| Параметр | Значение |
|---|---|
| Производитель | Supermicro |
| Модель | SYS-420GP-TNAR |
| Форм-фактор | 4U |
| GPU | 8× NVIDIA A100 SXM 80GB |
| Видеопамять | 640 ГБ HBM2e (8×80 ГБ) |
| Межсоединение GPU | NVLink с NVSwitch (HGX A100 8-GPU) |
| Процессор | 2× Socket P+ (LGA-4189), Intel Xeon Scalable 3-го поколения |
| Оперативная память | 32 DIMM, до 8 ТБ ECC DDR4 (в данной сборке 8192 ГБ) |
| Накопители | 6× 2.5" hot-swap NVMe/SATA/SAS, 2× M.2 NVMe/SATA (только загрузочные) |
| FP64 Tensor Core (все 8 GPU) | 156 TFLOPS |
| TF32 Tensor Core (все 8 GPU) | 2 496 TFLOPS |
| BF16 / FP16 Tensor Core (все 8 GPU) | 4 992 TFLOPS |
| INT8 Tensor Core (все 8 GPU) | 9 984 TOPS |
Для каких задач подходит
Сервер ориентирован на нагрузки, которым тесно на одном-двух ускорителях:
- обучение и дообучение моделей (training, fine-tuning), где нужна быстрая синхронизация между GPU;
- инференс и развёртывание крупных LLM: по оценкам из описания, квантизированные модели вроде DeepSeek-R1 685B в Q4_K_M (около 404 ГБ) помещаются в 640 ГБ VRAM, а Mistral-Large-3 675B в Q4_K_M требует около 407 ГБ;
- модели среднего размера, например gpt-oss:120b (около 196 ГБ), можно запускать на 2–4 GPU, оставляя запас под KV-cache и высокий throughput;
- RAG-системы, агентные сценарии и производственные LLM-сервисы;
- генерация изображений и видео: Stable Diffusion XL, Flux.2-dev, Kandinsky 5.0 — с распределением очередей по нескольким GPU;
- HPC и научные расчёты, анализ данных.
При запуске больших моделей закладывайте запас VRAM под KV-cache и подбирайте параллелизм по GPU под конкретный контекст и размер батча.
Состояние, проверка и гарантия
Сервер поставляется новым. Перед отправкой «СервакМастер» тестирует оборудование, на него действует гарантия 1 год с заменой компонентов. Доставка выполняется по России СДЭК и другими ведущими службами. Если нужна конфигурация этой платформы под ваши задачи и бюджет, свяжитесь с менеджером — мы подберём подходящий вариант.
Характеристики
| Тип | Новые |
| Основная задача | Обучение моделей / Инференс / Дообучение моделей / RAG-системы / Анализ данных / Научные расчеты (HPC) |
| Процессор (CPU) | Intel Xeon |
| Видеокарта (GPU) | NVIDIA A100 |
| Количество GPU, шт | 8 |
| Общий объем видеопамяти (VRAM), ГБ | 640 |
| Тип памяти GPU | HBM2e |
| Объем оперативной памяти (RAM), ГБ | 8192 |
| Тип оперативной памяти | DDR4 ECC REG |
| Форм-фактор | 4U |









