Сервер Supermicro SYS-420GP-TNAR+ с 8× NVIDIA A100 SXM 80GB (640 ГБ HBM2e)
Supermicro SYS-420GP-TNAR+: восемь A100 SXM в одном корпусе 4U
SYS-420GP-TNAR+ — это GPU-платформа на базе HGX A100 с восемью ускорителями NVIDIA A100 SXM по 80 ГБ памяти HBM2e. Суммарно доступно 640 ГБ видеопамяти, а ускорители объединены через NVLink/NVSwitch, поэтому нагрузка хорошо масштабируется между GPU.
Система рассчитана на задачи, где важна плотность вычислений: обучение и дообучение больших языковых моделей, промышленный инференс, RAG-системы и научные расчёты (HPC). Две процессорные панели и до 8 ТБ оперативной памяти позволяют не упираться в host-память при подготовке данных.
Ключевые особенности
- 8× NVIDIA A100 SXM 80GB (архитектура Ampere, CUDA и Tensor-ядра) с межсоединением NVLink/NVSwitch.
- 640 ГБ HBM2e в сумме: хватает для больших батчей и длинного контекста при контроле KV-cache.
- Два сокета Socket P+ (LGA-4189) под Intel Xeon Scalable 3-го поколения; для воздушного охлаждения заявлена поддержка процессоров до 270 Вт TDP.
- 32 слота DIMM, до 8 ТБ ECC DDR4; при сочетании с Intel Optane Persistent Memory — до 12 ТБ.
- Накопители: 6× 2,5" hot-swap NVMe/SATA/SAS спереди и 2× M.2 NVMe/SATA.
- Важное ограничение: слоты M.2 предназначены только под загрузочные диски, основные накопители ставятся во фронтальные отсеки.
Характеристики
| Параметр | Значение |
|---|---|
| Состояние | Новое |
| Форм-фактор | 4U |
| GPU | 8× NVIDIA A100 SXM 80GB |
| Видеопамять | 640 ГБ HBM2e (8×80 ГБ) |
| Процессоры | 2× Socket P+ (LGA-4189), Intel Xeon Scalable 3-го поколения |
| Оперативная память | 32 DIMM, до 8 ТБ ECC DDR4 (до 12 ТБ с Intel Optane PMem) |
| Отсеки хранения | 6× 2,5" hot-swap NVMe/SATA/SAS |
| Загрузочные диски | 2× M.2 NVMe/SATA (boot only) |
| FP64 Tensor Core (8 GPU) | 156 TFLOPS |
| TF32 Tensor Core (8 GPU) | 2 496 TFLOPS |
| BF16 / FP16 Tensor Core (8 GPU) | 4 992 TFLOPS |
| INT8 Tensor Core (8 GPU) | 9 984 TOPS |
Для каких задач подходит
Платформа ориентирована на обучение и дообучение моделей, развёртывание инференса, RAG-пайплайны, анализ данных и HPC-расчёты. По объёму VRAM в 4-битной квантизации комфортно размещаются крупные LLM: например, DeepSeek-R1 685B (Q4_K_M, около 404 ГБ), Mistral-Large-3 675B (Q4_K_M, около 407 ГБ) или GLM-5 (Q4_K_M, около 456 ГБ). Модель gpt-oss:120b (около 196 ГБ) помещается на 2–4 GPU, остальные ускорители остаются под параллельные запросы.
Для диффузионных моделей сервер тоже подходит: Stable Diffusion XL, Flux.2-dev (около 178 ГБ VRAM, лучше распределять по нескольким GPU) и Kandinsky 5.0 запускаются без проблем, а генерацию можно масштабировать по ускорителям для высокой пропускной способности.
Состояние, проверка и поставка
Сервер поставляется новым. Перед отправкой «СервакМастер» тестирует оборудование, на него действует гарантия 1 год с заменой компонентов. Доставка выполняется по России СДЭК и другими ведущими службами. Если нужна конфигурация под ваши задачи и бюджет, свяжитесь с менеджером — подберём подходящий вариант на этой платформе.
Характеристики
| Тип | Новые |
| Основная задача | Обучение моделей / Инференс / Дообучение моделей / RAG-системы / Анализ данных / Научные расчеты (HPC) |
| Процессор (CPU) | Intel Xeon |
| Видеокарта (GPU) | NVIDIA A100 |
| Количество GPU, шт | 8 |
| Общий объем видеопамяти (VRAM), ГБ | 640 |
| Тип памяти GPU | HBM2e |
| Объем оперативной памяти (RAM), ГБ | 8192 |
| Тип оперативной памяти | DDR4 ECC REG |
| Форм-фактор | 4U |









