GIGABYTE G893-ZX1-AAX1 — 8U GPU-сервер с 8× AMD Instinct MI300X 192GB
Обзор GIGABYTE G893-ZX1-AAX1
GIGABYTE G893-ZX1-AAX1 — это 8U-платформа для тяжёлых AI-нагрузок на базе восьми ускорителей AMD Instinct MI300X в форм-факторе OAM. Каждый ускоритель несёт 192 ГБ памяти HBM3, в сумме узел располагает 1536 ГБ (1,5 ТБ) видеопамяти. Это позволяет держать крупные языковые модели без жёстких компромиссов по длине контекста и размеру KV-cache.
Программный стек ориентирован на ROCm. В продакшн-сценариях на таких узлах часто применяют окружения на vLLM и PyTorch ROCm, а для MI300X в vLLM доступно FP8-квантование — оно снижает расход памяти и повышает пропускную способность, если нужна максимальная плотность моделей на узле.
Ключевые особенности
- 8 × AMD Instinct MI300X OAM по 192 ГБ HBM3, суммарно 1536 ГБ видеопамяти.
- Два процессора AMD EPYC 9005/9004 (сокет SP5, LGA 6096).
- До 6 ТБ оперативной памяти DDR5 ECC RDIMM, 24 слота.
- Восемь отсеков 2,5" NVMe и два слота M.2 (2280/22110) для накопителей.
- Совокупная пиковая мощность восьми GPU: 10,4 PFLOPS в FP16 и BF16, 20,88 PFLOPS в FP8; с разреженностью — 20,88 PFLOPS в FP16 и 41,76 PFLOPS в FP8.
- FP64: 653,6 TFLOPS, FP32: 1304 TFLOPS; INT8: 20,8 POPS.
- Запас памяти под параллельное обслуживание запросов, раздельные очереди и несколько пайплайнов одновременно.
Характеристики
| Параметр | Значение |
|---|---|
| Состояние | Новое |
| Форм-фактор | 8U |
| Ускорители | 8× AMD Instinct MI300X OAM |
| Память GPU | 192 ГБ HBM3 на ускоритель, 1536 ГБ суммарно |
| Процессор | 2× AMD EPYC 9005/9004 (SP5, LGA 6096) |
| Оперативная память | до 6 ТБ DDR5 ECC RDIMM, 24 слота |
| Накопители NVMe | 8× 2,5" NVMe |
| Слоты M.2 | 1× M.2 (2280/22110) PCIe Gen3 x4, 1× M.2 (2280/22110) PCIe Gen3 x1 |
| Производительность FP16 / BF16 | 10,4 PFLOPS (совокупно) |
| Производительность FP8 | 20,88 PFLOPS (совокупно) |
Для каких задач подходит
Платформа рассчитана на обучение и дообучение моделей, инференс и развёртывание, RAG-системы, анализ данных и научные расчёты (HPC). По описанию платформы, на восьми ускорителях без квантизации уверенно запускаются такие модели, как DeepSeek-R1 685B (около 689 ГБ VRAM), GigaChat3-702B-A36B-preview (около 720 ГБ) и Mistral-Large-3-675B-Instruct (около 682 ГБ), с запасом под длинный контекст и батчи. Модель Qwen3.5-397B-A17B требует около 807 ГБ, а GLM-5 в режиме FP8 — около 756 ГБ. Компактная gpt-oss:120b (около 196 ГБ) помещается на двух GPU, а остальные ускорители остаются под высокий QPS.
Для диффузионных моделей — Stable Diffusion XL 1.0, Flux.2-dev, SD Turbo, Kandinsky-5.0 (изображения и короткое видео) — большой объём памяти позволяет распараллеливать генерацию по GPU и разделять задачи, например выделять часть ускорителей под быстрые превью, а остальные под финальный рендер.
Состояние, проверка и поставка
Сервер поставляется новым. Перед отправкой «СервакМастер» тестирует оборудование, на него действует гарантия 1 год с заменой компонентов, а доставка по России выполняется СДЭК и другими службами доставки. Если нужна конфигурация на эту платформу под ваши задачи, свяжитесь с менеджером — мы предложим вариант под бюджет и требования.
Характеристики
| Тип | Новые |
| Основная задача | Обучение моделей / Инференс / Дообучение моделей / RAG-системы / Анализ данных / Научные расчеты (HPC) |
| Процессор (CPU) | AMD EPYC |
| Видеокарта (GPU) | AMD Instinct MI300X |
| Количество GPU, шт | 8 |
| Общий объем видеопамяти (VRAM), ГБ | 1536 |
| Тип памяти GPU | HBM3 |
| Объем оперативной памяти (RAM), ГБ | 6144 |
| Тип оперативной памяти | DDR5 ECC REG |
| Форм-фактор | 8U |





























