GPU-сервер Supermicro AS-4124GO-NART на 8× NVIDIA A100 SXM 80GB (640 ГБ HBM2e)
Supermicro AS-4124GO-NART: восемь A100 SXM в одном узле
Supermicro AS-4124GO-NART в этой конфигурации построен на платформе NVIDIA HGX A100 с восемью ускорителями A100 SXM 80GB. Суммарно сервер даёт 640 ГБ видеопамяти HBM2e, и это определяет его назначение: обучение и дообучение крупных моделей, развёртывание инференса с большим числом параллельных сессий, RAG-системы и научные расчёты.
Главное достоинство платформы в том, что GPU тесно связаны между собой. Ускорители объединены через NVLink v3 и NVSwitch, а сетевая топология рассчитана на GPUDirect RDMA по схеме «одна сетевая карта на один GPU». Для распределённого обучения и интенсивного обмена данными между узлами это важнее, чем простая сумма вычислительной мощности.
Ключевые особенности
- 8× NVIDIA A100 SXM 80GB с памятью HBM2e, всего 640 ГБ VRAM.
- NVLink v3 и NVSwitch для связи между всеми GPU узла.
- Топология NIC под GPUDirect RDMA, соотношение 1 GPU к 1 NIC.
- Два процессора AMD EPYC 7002/7003 в Dual Socket SP3, до 280 Вт TDP на каждый.
- 32 слота DIMM, память Registered ECC до 8 ТБ.
- 6 передних hot-swap отсеков 2.5" NVMe; с дополнительными задними корзинами доступно до 10× U.2 NVMe 2.5".
- 2× M.2 NVMe PCIe 3.0 (2280, 22110) под системные задачи.
- Корпус 4U.
Характеристики
| Параметр | Значение |
|---|---|
| Состояние | Новое |
| Форм-фактор | 4U |
| GPU | 8× NVIDIA A100 SXM 80GB |
| Видеопамять | 640 ГБ, HBM2e |
| Процессор | 2× AMD EPYC 7002/7003 (SP3, до 280 Вт TDP) |
| Оперативная память | до 8 ТБ (8192 ГБ) Registered ECC, 32 DIMM |
| Накопители | 6× hot-swap 2.5" NVMe, опционально до 10× U.2 NVMe 2.5" |
| Загрузочные M.2 | 2× M.2 NVMe PCIe 3.0 (2280, 22110) |
| Связь GPU | NVLink v3, NVSwitch |
| Сеть | GPUDirect RDMA, 1 GPU : 1 NIC |
Совокупная производительность восьми A100 SXM по типам точности: FP64 Tensor Core 156 TFLOPS, TF32 Tensor Core 2 496 TFLOPS, BF16/FP16 Tensor Core 4 992 TFLOPS, INT8 Tensor Core 9 984 TOPS.
Для каких задач подходит
- Обучение и дообучение моделей. Восемь связанных GPU с общим объёмом 640 ГБ позволяют масштабировать задачу по 4-8 ускорителям.
- Инференс больших языковых моделей. Запас видеопамяти остаётся под KV-cache и параллельные сессии. По расчётам поставщика, в 4-битной квантизации комфортно размещаются модели уровня DeepSeek-R1 685B (около 404 ГБ), Mistral-Large-3 675B (около 407 ГБ) и GLM-5 (около 456 ГБ), а gpt-oss:120b (около 196 ГБ) можно держать на 2-4 GPU.
- Диффузионные модели. Stable Diffusion XL, Flux.2-dev, Kandinsky 5.0 и другие хорошо распараллеливаются по GPU для пакетной генерации изображений и коротких видео.
- RAG-системы, анализ данных и HPC. Высокая связанность GPU и быстрые NVMe-накопители подходят для научных расчётов и тяжёлых аналитических пайплайнов.
Состояние, проверка и поставка
Сервер поставляется новым. Перед отправкой «СервакМастер» тестирует оборудование, на него действует гарантия 1 год с заменой компонентов. Доставка выполняется по России службой СДЭК и другими ведущими службами доставки. Если нужна конфигурация на эту платформу под ваши задачи, свяжитесь с менеджером: мы предложим вариант под бюджет и требования.
Характеристики
| Тип | Новые |
| Основная задача | Обучение моделей / Инференс / Дообучение моделей / RAG-системы / Анализ данных / Научные расчеты (HPC) |
| Процессор (CPU) | AMD EPYC |
| Видеокарта (GPU) | NVIDIA A100 |
| Количество GPU, шт | 8 |
| Общий объем видеопамяти (VRAM), ГБ | 640 |
| Тип памяти GPU | HBM2e |
| Объем оперативной памяти (RAM), ГБ | 8192 |
| Тип оперативной памяти | DDR5 ECC REG |
| Форм-фактор | 4U |









