GIGABYTE G893-ZX1-AAX3 — 8U GPU-сервер с 8× AMD Instinct MI350X 288GB
Обзор: GPU-сервер уровня дата-центра для больших моделей
GIGABYTE G893-ZX1-AAX3 — это 8U-платформа, в которой установлено восемь ускорителей AMD Instinct MI350X в формате OAM. У каждого ускорителя по 288 ГБ памяти HBM3e, поэтому на одном узле доступно 2304 ГБ видеопамяти. Такой объём позволяет держать в памяти очень крупные языковые модели, длинный контекст и объёмный KV-cache без дробления задачи на несколько серверов.
Вычислительную часть дополняют два процессора AMD EPYC серий 9005/9004 (сокет SP5) и до 6 ТБ оперативной памяти DDR5 ECC RDIMM в 24 слотах. Это конфигурация для команд, которые обучают и дообучают модели, запускают промышленный инференс и считают задачи HPC в собственном контуре.
Ключевые особенности
- 8 × AMD Instinct MI350X OAM по 288 ГБ HBM3e — суммарно 2304 ГБ памяти ускорителей.
- Две платформы AMD EPYC 9005/9004 (SP5) для подачи данных на GPU и обработки сопутствующих задач.
- До 6 ТБ DDR5 ECC RDIMM, 24 слота — запас под большие датасеты, RAG-индексы и предобработку.
- Хранилище: 8 отсеков 2,5" с NVMe Gen5 и два слота M.2 (PCIe Gen3 x4 и x1, 2280/22110).
- Производительность узла при восьми ускорителях: до 36,8 PFLOPS в FP8 (73,6 PFLOPS со структурированной разреженностью), 18,4 PFLOPS в FP16/BF16 Matrix, 576,8 TFLOPS в FP64.
- Запас по памяти для высокой параллельности запросов: на одном узле помещаются полноразмерные модели с терабайтными требованиями к VRAM, а компактные модели можно разнести по отдельным GPU.
Характеристики
| Параметр | Значение |
|---|---|
| Модель | GIGABYTE G893-ZX1-AAX3 |
| Форм-фактор | 8U |
| Ускорители | 8× AMD Instinct MI350X OAM |
| Память ускорителей | 288 ГБ HBM3e на GPU, 2304 ГБ суммарно |
| Процессор | 2× AMD EPYC 9005/9004 (SP5, LGA 6096) |
| Оперативная память | до 6 ТБ DDR5 ECC RDIMM, 24 слота |
| Накопители | 8× 2,5" NVMe Gen5, 2× M.2 (PCIe Gen3 x4 и x1) |
| FP8 (совокупно) | 36,8 PFLOPS |
| FP64 (совокупно) | 576,8 TFLOPS |
| Состояние | Новое |
Для каких задач подходит
- Обучение и дообучение моделей — большой объём HBM3e на узле снижает потребность в сложном распределении по нескольким машинам.
- Инференс в продакшене — запуск крупных LLM, в том числе без агрессивной квантизации, с запасом под KV-cache и параллельные запросы.
- RAG-системы и агентные сценарии — достаточно памяти и CPU-ресурсов для моделей, векторных индексов и сопутствующих сервисов.
- Диффузионные модели — генерацию изображений и короткого видео можно распараллелить по восьми GPU.
- HPC и научные расчёты — высокая производительность в FP64 и FP32 для моделирования и анализа данных.
Состояние, проверка и гарантия
Сервер поставляется новым. Перед отправкой «СервакМастер» тестирует оборудование, на него действует гарантия 1 год с заменой компонентов. Доставка по России осуществляется через СДЭК и другие ведущие службы. Если нужна конфигурация этой платформы под ваш бюджет и задачи, свяжитесь с менеджером — он поможет подобрать подходящий вариант.
Характеристики
| Тип | Новые |
| Основная задача | Обучение моделей / Инференс / Дообучение моделей / RAG-системы / Анализ данных / Научные расчеты (HPC) |
| Процессор (CPU) | AMD EPYC |
| Видеокарта (GPU) | AMD Instinct MI350X |
| Количество GPU, шт | 8 |
| Общий объем видеопамяти (VRAM), ГБ | 2304 |
| Тип памяти GPU | HBM3e |
| Объем оперативной памяти (RAM), ГБ | 6144 |
| Тип оперативной памяти | DDR5 ECC REG |
| Форм-фактор | 8U |





























