Сервер GIGABYTE G893-ZX1-AAX2 на 8× AMD Instinct MI325X 256GB HBM3e

Обзор: GPU-сервер GIGABYTE G893-ZX1-AAX2 для крупных AI-задач

GIGABYTE G893-ZX1-AAX2 — платформа формата 8U, рассчитанная на тяжёлые нагрузки машинного обучения и высокопроизводительных вычислений. В этой конфигурации установлено восемь ускорителей AMD Instinct MI325X в форм-факторе OAM, по 256 ГБ памяти HBM3e на каждый, то есть 2048 ГБ (2 ТБ) видеопамяти в одном узле.

Такой объём позволяет держать в памяти очень большие модели вместе с длинным контекстом, KV-кешем и несколькими параллельными очередями запросов. Программный стек строится вокруг ROCm, поэтому сервер подходит для продакшн-развёртывания языковых моделей с высоким параллелизмом, а также для обучения и дообучения.

Ключевые особенности

  • 8 ускорителей AMD Instinct MI325X OAM, по 256 ГБ HBM3e, суммарно 2048 ГБ видеопамяти.
  • Два процессора AMD EPYC серий 9005/9004 на сокете SP5 (LGA 6096).
  • До 6 ТБ оперативной памяти DDR5 ECC RDIMM, 24 слота.
  • Совокупная мощность восьми ускорителей: 20,9 PFLOPS в FP8 (41,8 PFLOPS при структурированной разреженности), 10,5 PFLOPS в FP16 и BF16 (20,9 PFLOPS с разреженностью).
  • Производительность FP64 — 653,6 TFLOPS, FP64 Matrix — 1,3 PFLOPS, что важно для научных расчётов.
  • Восемь отсеков 2,5" NVMe и два слота M.2 (2280/22110) для накопителей.
  • Платформа рассчитана на работу с ROCm.

Характеристики

Параметр Значение
Состояние Новое
Форм-фактор 8U
Видеокарты 8× AMD Instinct MI325X OAM 256GB HBM3e
Общий объём VRAM 2048 ГБ
Процессор 2× AMD EPYC 9005/9004 (SP5, LGA 6096)
Оперативная память до 6 ТБ DDR5 ECC RDIMM, 24 слота
Накопители 8× 2,5" NVMe, 2× M.2 (2280/22110)
FP8 (8 GPU) 20,9 PFLOPS, 41,8 PFLOPS с разреженностью
FP16 / BF16 (8 GPU) 10,5 PFLOPS, 20,9 PFLOPS с разреженностью
FP64 (8 GPU) 653,6 TFLOPS

Для каких задач подходит

  • Обучение и дообучение больших языковых моделей на одном узле.
  • Инференс и продакшн-serving моделей масштаба сотен миллиардов параметров. По данным поставщика, DeepSeek-R1 685B требует около 689 ГБ, Mistral-Large-3-675B — около 682 ГБ, а GLM-5 — около 1,51 ТБ, и всё это помещается в память 8 ускорителей без квантизации.
  • RAG-системы и анализ данных, где нужен большой запас памяти под контекст и параллельные запросы.
  • Генерация изображений и видео диффузионными моделями: SDXL, Flux.2-dev, Kandinsky 5.0 — с большими батчами и распределением очередей по нескольким GPU.
  • Научные расчёты и HPC-нагрузки, использующие FP64.

Состояние, проверка и доставка

Сервер поставляется новым. Перед отправкой «СервакМастер» тестирует оборудование, на него действует гарантия 1 год с заменой компонентов. Доставка по России выполняется СДЭК и другими ведущими службами. Если нужна конфигурация на эту платформу под ваши задачи, свяжитесь с менеджером — мы подберём вариант под бюджет и требования.

Характеристики

ТипНовые
Основная задачаОбучение моделей / Инференс / Дообучение моделей / RAG-системы / Анализ данных / Научные расчеты (HPC)
Процессор (CPU)AMD EPYC
Видеокарта (GPU)AMD Instinct MI325X
Количество GPU, шт8
Общий объем видеопамяти (VRAM), ГБ2048
Тип памяти GPUHBM3e
Объем оперативной памяти (RAM), ГБ6144
Тип оперативной памятиDDR5 ECC REG
Форм-фактор8U
29 393 550 руб.
Под заказ
Задать вопрос
Гарантия с заменой компонентов
Доставка СДЭК и ведущими службами доставки
Помощь в подборе конфигурации
Характеристики
ТипНовые
Основная задачаОбучение моделей / Инференс / Дообучение моделей / RAG-системы / Анализ данных / Научные расчеты (HPC)
Процессор (CPU)AMD EPYC
Видеокарта (GPU)AMD Instinct MI325X
Количество GPU, шт8
Общий объем видеопамяти (VRAM), ГБ2048
Тип памяти GPUHBM3e
Объем оперативной памяти (RAM), ГБ6144
Тип оперативной памятиDDR5 ECC REG
Форм-фактор8U

Есть вопросы?

Поможем выбрать, проконсультируем по всем услугам, расскажем о средствах решения ваших задач
Заказать консультацию