Сервер Supermicro AS-A126GS-TNBR на 8× NVIDIA B200 SXM 180GB, 1440 ГБ HBM3e

Supermicro AS-A126GS-TNBR: 8-GPU узел на базе NVIDIA HGX B200

Supermicro AS-A126GS-TNBR — это GPU-сервер для тех, кому нужен весь объём вычислений в одном шасси. В основе платформа NVIDIA HGX B200 с восемью ускорителями B200 SXM по 180 ГБ памяти HBM3e. Суммарно получается 1440 ГБ видеопамяти (около 1,4 ТБ), и этого хватает для длинного контекста, крупных батчей и высокой параллельности запросов без постоянного упора в память.

Архитектура Blackwell хорошо работает с форматами FP16, FP8 и INT8. В продакшн-инференсе удобно сочетать tensor parallel на 4–8 GPU с аккуратным управлением KV-cache. Ускорители связаны через NVLink с NVSwitch, а процессоры подключены к ним по PCIe 5.0 x16. Это снижает накладные расходы при интенсивном обмене данными между GPU.

Ключевые особенности

  • 8× NVIDIA B200 SXM, по 180 ГБ HBM3e на каждый ускоритель, всего 1440 ГБ.
  • Два процессора AMD EPYC 9005/9004 с TDP до 500 Вт, сокет SP5 (LGA 6096).
  • До 6 ТБ оперативной памяти DDR5 ECC RDIMM в 24 слотах (скорость зависит от поколения CPU).
  • Фронтальные отсеки: 8 hot-swap 2.5" NVMe и 2 hot-swap 2.5" SATA, опционально 8 накопителей E1.S NVMe.
  • Две посадочные позиции M.2 NVMe, например под загрузочные диски.
  • Связь GPU через NVLink и NVSwitch, связь CPU и GPU через PCIe 5.0 x16.
  • Форм-фактор 10U.

Характеристики

Параметр Значение
Состояние Новое
Видеокарты 8× NVIDIA B200 SXM 180 ГБ
Видеопамять (суммарно) 1440 ГБ HBM3e
Процессор 2× AMD EPYC 9005/9004 (SP5, LGA 6096)
Оперативная память до 6 ТБ DDR5 ECC RDIMM, 24 слота
Накопители 8× hot-swap 2.5" NVMe + 2× hot-swap 2.5" SATA, 2× M.2 NVMe
Межсоединение GPU NVLink с NVSwitch
Связь CPU и GPU PCIe 5.0 x16
Форм-фактор 10U

По заявленной производительности совокупная мощность восьми GPU составляет 36 PFLOPS в BF16/FP16, 72 PFLOPS в FP8/FP6 и 144 PFLOPS в FP4. Для INT8 указано 72 POPS.

Для каких задач подходит

  • Обучение и дообучение больших языковых моделей, когда важна эффективность масштабирования внутри одного узла.
  • Инференс и развёртывание LLM в продакшне. По данным производителя конфигурации, в память без квантизации помещаются модели порядка 600–870 ГБ, например DeepSeek-V4-Pro (около 865 ГБ) и GigaChat3.5-432B-A28B-bf16 (около 868 ГБ).
  • Более лёгкие модели, например gpt-oss:120b (около 196 ГБ), можно разместить на 2–4 GPU. Оставшаяся память пойдёт под высокую параллельность и KV-cache.
  • RAG-системы и агентные сценарии с длинным контекстом.
  • Научные расчёты (HPC) и анализ данных.
  • Генерация изображений и видео: Stable Diffusion XL, Flux.2-dev, Kandinsky 5.0 — задачи удобно распределять по нескольким GPU.

Состояние, проверка и поставка

Сервер поставляется новым. Перед отправкой «СервакМастер» тестирует оборудование, на него действует гарантия 1 год с заменой компонентов. Доставка осуществляется по России СДЭК и другими ведущими службами. Если нужна конфигурация на этой платформе под ваши задачи и бюджет, свяжитесь с менеджером, и мы подберём подходящий вариант.

Характеристики

ТипНовые
Основная задачаОбучение моделей / Инференс / Дообучение моделей / RAG-системы / Анализ данных / Научные расчеты (HPC) / Визуализация и рендеринг
Процессор (CPU)AMD EPYC
Видеокарта (GPU)NVIDIA B200 SXM
Количество GPU, шт8
Общий объем видеопамяти (VRAM), ГБ1440
Тип памяти GPUHBM3e
Объем оперативной памяти (RAM), ГБ6144
Тип оперативной памятиDDR5 ECC REG
Форм-фактор10U
90 912 500 руб.
Под заказ
Задать вопрос
Гарантия с заменой компонентов
Доставка СДЭК и ведущими службами доставки
Помощь в подборе конфигурации
Характеристики
ТипНовые
Основная задачаОбучение моделей / Инференс / Дообучение моделей / RAG-системы / Анализ данных / Научные расчеты (HPC) / Визуализация и рендеринг
Процессор (CPU)AMD EPYC
Видеокарта (GPU)NVIDIA B200 SXM
Количество GPU, шт8
Общий объем видеопамяти (VRAM), ГБ1440
Тип памяти GPUHBM3e
Объем оперативной памяти (RAM), ГБ6144
Тип оперативной памятиDDR5 ECC REG
Форм-фактор10U

Есть вопросы?

Поможем выбрать, проконсультируем по всем услугам, расскажем о средствах решения ваших задач
Заказать консультацию