Сервер Supermicro AS-A126GS-TNBR на 8× NVIDIA B200 SXM 180GB, 1440 ГБ HBM3e
Supermicro AS-A126GS-TNBR: 8-GPU узел на базе NVIDIA HGX B200
Supermicro AS-A126GS-TNBR — это GPU-сервер для тех, кому нужен весь объём вычислений в одном шасси. В основе платформа NVIDIA HGX B200 с восемью ускорителями B200 SXM по 180 ГБ памяти HBM3e. Суммарно получается 1440 ГБ видеопамяти (около 1,4 ТБ), и этого хватает для длинного контекста, крупных батчей и высокой параллельности запросов без постоянного упора в память.
Архитектура Blackwell хорошо работает с форматами FP16, FP8 и INT8. В продакшн-инференсе удобно сочетать tensor parallel на 4–8 GPU с аккуратным управлением KV-cache. Ускорители связаны через NVLink с NVSwitch, а процессоры подключены к ним по PCIe 5.0 x16. Это снижает накладные расходы при интенсивном обмене данными между GPU.
Ключевые особенности
- 8× NVIDIA B200 SXM, по 180 ГБ HBM3e на каждый ускоритель, всего 1440 ГБ.
- Два процессора AMD EPYC 9005/9004 с TDP до 500 Вт, сокет SP5 (LGA 6096).
- До 6 ТБ оперативной памяти DDR5 ECC RDIMM в 24 слотах (скорость зависит от поколения CPU).
- Фронтальные отсеки: 8 hot-swap 2.5" NVMe и 2 hot-swap 2.5" SATA, опционально 8 накопителей E1.S NVMe.
- Две посадочные позиции M.2 NVMe, например под загрузочные диски.
- Связь GPU через NVLink и NVSwitch, связь CPU и GPU через PCIe 5.0 x16.
- Форм-фактор 10U.
Характеристики
| Параметр | Значение |
|---|---|
| Состояние | Новое |
| Видеокарты | 8× NVIDIA B200 SXM 180 ГБ |
| Видеопамять (суммарно) | 1440 ГБ HBM3e |
| Процессор | 2× AMD EPYC 9005/9004 (SP5, LGA 6096) |
| Оперативная память | до 6 ТБ DDR5 ECC RDIMM, 24 слота |
| Накопители | 8× hot-swap 2.5" NVMe + 2× hot-swap 2.5" SATA, 2× M.2 NVMe |
| Межсоединение GPU | NVLink с NVSwitch |
| Связь CPU и GPU | PCIe 5.0 x16 |
| Форм-фактор | 10U |
По заявленной производительности совокупная мощность восьми GPU составляет 36 PFLOPS в BF16/FP16, 72 PFLOPS в FP8/FP6 и 144 PFLOPS в FP4. Для INT8 указано 72 POPS.
Для каких задач подходит
- Обучение и дообучение больших языковых моделей, когда важна эффективность масштабирования внутри одного узла.
- Инференс и развёртывание LLM в продакшне. По данным производителя конфигурации, в память без квантизации помещаются модели порядка 600–870 ГБ, например DeepSeek-V4-Pro (около 865 ГБ) и GigaChat3.5-432B-A28B-bf16 (около 868 ГБ).
- Более лёгкие модели, например gpt-oss:120b (около 196 ГБ), можно разместить на 2–4 GPU. Оставшаяся память пойдёт под высокую параллельность и KV-cache.
- RAG-системы и агентные сценарии с длинным контекстом.
- Научные расчёты (HPC) и анализ данных.
- Генерация изображений и видео: Stable Diffusion XL, Flux.2-dev, Kandinsky 5.0 — задачи удобно распределять по нескольким GPU.
Состояние, проверка и поставка
Сервер поставляется новым. Перед отправкой «СервакМастер» тестирует оборудование, на него действует гарантия 1 год с заменой компонентов. Доставка осуществляется по России СДЭК и другими ведущими службами. Если нужна конфигурация на этой платформе под ваши задачи и бюджет, свяжитесь с менеджером, и мы подберём подходящий вариант.
Характеристики
| Тип | Новые |
| Основная задача | Обучение моделей / Инференс / Дообучение моделей / RAG-системы / Анализ данных / Научные расчеты (HPC) / Визуализация и рендеринг |
| Процессор (CPU) | AMD EPYC |
| Видеокарта (GPU) | NVIDIA B200 SXM |
| Количество GPU, шт | 8 |
| Общий объем видеопамяти (VRAM), ГБ | 1440 |
| Тип памяти GPU | HBM3e |
| Объем оперативной памяти (RAM), ГБ | 6144 |
| Тип оперативной памяти | DDR5 ECC REG |
| Форм-фактор | 10U |







