GIGABYTE G893-ZX1-AAX3 — 8U GPU-сервер с 8× AMD Instinct MI350X 288GB

Обзор: GPU-сервер уровня дата-центра для больших моделей

GIGABYTE G893-ZX1-AAX3 — это 8U-платформа, в которой установлено восемь ускорителей AMD Instinct MI350X в формате OAM. У каждого ускорителя по 288 ГБ памяти HBM3e, поэтому на одном узле доступно 2304 ГБ видеопамяти. Такой объём позволяет держать в памяти очень крупные языковые модели, длинный контекст и объёмный KV-cache без дробления задачи на несколько серверов.

Вычислительную часть дополняют два процессора AMD EPYC серий 9005/9004 (сокет SP5) и до 6 ТБ оперативной памяти DDR5 ECC RDIMM в 24 слотах. Это конфигурация для команд, которые обучают и дообучают модели, запускают промышленный инференс и считают задачи HPC в собственном контуре.

Ключевые особенности

  • 8 × AMD Instinct MI350X OAM по 288 ГБ HBM3e — суммарно 2304 ГБ памяти ускорителей.
  • Две платформы AMD EPYC 9005/9004 (SP5) для подачи данных на GPU и обработки сопутствующих задач.
  • До 6 ТБ DDR5 ECC RDIMM, 24 слота — запас под большие датасеты, RAG-индексы и предобработку.
  • Хранилище: 8 отсеков 2,5" с NVMe Gen5 и два слота M.2 (PCIe Gen3 x4 и x1, 2280/22110).
  • Производительность узла при восьми ускорителях: до 36,8 PFLOPS в FP8 (73,6 PFLOPS со структурированной разреженностью), 18,4 PFLOPS в FP16/BF16 Matrix, 576,8 TFLOPS в FP64.
  • Запас по памяти для высокой параллельности запросов: на одном узле помещаются полноразмерные модели с терабайтными требованиями к VRAM, а компактные модели можно разнести по отдельным GPU.

Характеристики

Параметр Значение
Модель GIGABYTE G893-ZX1-AAX3
Форм-фактор 8U
Ускорители 8× AMD Instinct MI350X OAM
Память ускорителей 288 ГБ HBM3e на GPU, 2304 ГБ суммарно
Процессор 2× AMD EPYC 9005/9004 (SP5, LGA 6096)
Оперативная память до 6 ТБ DDR5 ECC RDIMM, 24 слота
Накопители 8× 2,5" NVMe Gen5, 2× M.2 (PCIe Gen3 x4 и x1)
FP8 (совокупно) 36,8 PFLOPS
FP64 (совокупно) 576,8 TFLOPS
Состояние Новое

Для каких задач подходит

  • Обучение и дообучение моделей — большой объём HBM3e на узле снижает потребность в сложном распределении по нескольким машинам.
  • Инференс в продакшене — запуск крупных LLM, в том числе без агрессивной квантизации, с запасом под KV-cache и параллельные запросы.
  • RAG-системы и агентные сценарии — достаточно памяти и CPU-ресурсов для моделей, векторных индексов и сопутствующих сервисов.
  • Диффузионные модели — генерацию изображений и короткого видео можно распараллелить по восьми GPU.
  • HPC и научные расчёты — высокая производительность в FP64 и FP32 для моделирования и анализа данных.

Состояние, проверка и гарантия

Сервер поставляется новым. Перед отправкой «СервакМастер» тестирует оборудование, на него действует гарантия 1 год с заменой компонентов. Доставка по России осуществляется через СДЭК и другие ведущие службы. Если нужна конфигурация этой платформы под ваш бюджет и задачи, свяжитесь с менеджером — он поможет подобрать подходящий вариант.

Характеристики

ТипНовые
Основная задачаОбучение моделей / Инференс / Дообучение моделей / RAG-системы / Анализ данных / Научные расчеты (HPC)
Процессор (CPU)AMD EPYC
Видеокарта (GPU)AMD Instinct MI350X
Количество GPU, шт8
Общий объем видеопамяти (VRAM), ГБ2304
Тип памяти GPUHBM3e
Объем оперативной памяти (RAM), ГБ6144
Тип оперативной памятиDDR5 ECC REG
Форм-фактор8U
48 690 000 руб.
Под заказ
Задать вопрос
Гарантия с заменой компонентов
Доставка СДЭК и ведущими службами доставки
Помощь в подборе конфигурации
Характеристики
ТипНовые
Основная задачаОбучение моделей / Инференс / Дообучение моделей / RAG-системы / Анализ данных / Научные расчеты (HPC)
Процессор (CPU)AMD EPYC
Видеокарта (GPU)AMD Instinct MI350X
Количество GPU, шт8
Общий объем видеопамяти (VRAM), ГБ2304
Тип памяти GPUHBM3e
Объем оперативной памяти (RAM), ГБ6144
Тип оперативной памятиDDR5 ECC REG
Форм-фактор8U

Есть вопросы?

Поможем выбрать, проконсультируем по всем услугам, расскажем о средствах решения ваших задач
Заказать консультацию