GIGABYTE G893-ZX1-AAX1 — 8U GPU-сервер с 8× AMD Instinct MI300X 192GB

Обзор GIGABYTE G893-ZX1-AAX1

GIGABYTE G893-ZX1-AAX1 — это 8U-платформа для тяжёлых AI-нагрузок на базе восьми ускорителей AMD Instinct MI300X в форм-факторе OAM. Каждый ускоритель несёт 192 ГБ памяти HBM3, в сумме узел располагает 1536 ГБ (1,5 ТБ) видеопамяти. Это позволяет держать крупные языковые модели без жёстких компромиссов по длине контекста и размеру KV-cache.

Программный стек ориентирован на ROCm. В продакшн-сценариях на таких узлах часто применяют окружения на vLLM и PyTorch ROCm, а для MI300X в vLLM доступно FP8-квантование — оно снижает расход памяти и повышает пропускную способность, если нужна максимальная плотность моделей на узле.

Ключевые особенности

  • 8 × AMD Instinct MI300X OAM по 192 ГБ HBM3, суммарно 1536 ГБ видеопамяти.
  • Два процессора AMD EPYC 9005/9004 (сокет SP5, LGA 6096).
  • До 6 ТБ оперативной памяти DDR5 ECC RDIMM, 24 слота.
  • Восемь отсеков 2,5" NVMe и два слота M.2 (2280/22110) для накопителей.
  • Совокупная пиковая мощность восьми GPU: 10,4 PFLOPS в FP16 и BF16, 20,88 PFLOPS в FP8; с разреженностью — 20,88 PFLOPS в FP16 и 41,76 PFLOPS в FP8.
  • FP64: 653,6 TFLOPS, FP32: 1304 TFLOPS; INT8: 20,8 POPS.
  • Запас памяти под параллельное обслуживание запросов, раздельные очереди и несколько пайплайнов одновременно.

Характеристики

Параметр Значение
Состояние Новое
Форм-фактор 8U
Ускорители 8× AMD Instinct MI300X OAM
Память GPU 192 ГБ HBM3 на ускоритель, 1536 ГБ суммарно
Процессор 2× AMD EPYC 9005/9004 (SP5, LGA 6096)
Оперативная память до 6 ТБ DDR5 ECC RDIMM, 24 слота
Накопители NVMe 8× 2,5" NVMe
Слоты M.2 1× M.2 (2280/22110) PCIe Gen3 x4, 1× M.2 (2280/22110) PCIe Gen3 x1
Производительность FP16 / BF16 10,4 PFLOPS (совокупно)
Производительность FP8 20,88 PFLOPS (совокупно)

Для каких задач подходит

Платформа рассчитана на обучение и дообучение моделей, инференс и развёртывание, RAG-системы, анализ данных и научные расчёты (HPC). По описанию платформы, на восьми ускорителях без квантизации уверенно запускаются такие модели, как DeepSeek-R1 685B (около 689 ГБ VRAM), GigaChat3-702B-A36B-preview (около 720 ГБ) и Mistral-Large-3-675B-Instruct (около 682 ГБ), с запасом под длинный контекст и батчи. Модель Qwen3.5-397B-A17B требует около 807 ГБ, а GLM-5 в режиме FP8 — около 756 ГБ. Компактная gpt-oss:120b (около 196 ГБ) помещается на двух GPU, а остальные ускорители остаются под высокий QPS.

Для диффузионных моделей — Stable Diffusion XL 1.0, Flux.2-dev, SD Turbo, Kandinsky-5.0 (изображения и короткое видео) — большой объём памяти позволяет распараллеливать генерацию по GPU и разделять задачи, например выделять часть ускорителей под быстрые превью, а остальные под финальный рендер.

Состояние, проверка и поставка

Сервер поставляется новым. Перед отправкой «СервакМастер» тестирует оборудование, на него действует гарантия 1 год с заменой компонентов, а доставка по России выполняется СДЭК и другими службами доставки. Если нужна конфигурация на эту платформу под ваши задачи, свяжитесь с менеджером — мы предложим вариант под бюджет и требования.

Характеристики

ТипНовые
Основная задачаОбучение моделей / Инференс / Дообучение моделей / RAG-системы / Анализ данных / Научные расчеты (HPC)
Процессор (CPU)AMD EPYC
Видеокарта (GPU)AMD Instinct MI300X
Количество GPU, шт8
Общий объем видеопамяти (VRAM), ГБ1536
Тип памяти GPUHBM3
Объем оперативной памяти (RAM), ГБ6144
Тип оперативной памятиDDR5 ECC REG
Форм-фактор8U
25 559 600 руб.
Под заказ
Задать вопрос
Гарантия с заменой компонентов
Доставка СДЭК и ведущими службами доставки
Помощь в подборе конфигурации
Характеристики
ТипНовые
Основная задачаОбучение моделей / Инференс / Дообучение моделей / RAG-системы / Анализ данных / Научные расчеты (HPC)
Процессор (CPU)AMD EPYC
Видеокарта (GPU)AMD Instinct MI300X
Количество GPU, шт8
Общий объем видеопамяти (VRAM), ГБ1536
Тип памяти GPUHBM3
Объем оперативной памяти (RAM), ГБ6144
Тип оперативной памятиDDR5 ECC REG
Форм-фактор8U

Есть вопросы?

Поможем выбрать, проконсультируем по всем услугам, расскажем о средствах решения ваших задач
Заказать консультацию