Сервер GIGABYTE G492-PD0 на 8× NVIDIA A100 SXM 80GB, 640 ГБ HBM2e
GIGABYTE G492-PD0: GPU-платформа HGX для больших нейросетей
GIGABYTE G492-PD0 — это 4U-сервер на базе платформы NVIDIA HGX, в которую установлены восемь ускорителей A100 SXM с 80 ГБ памяти HBM2e каждый. Суммарно получается 640 ГБ видеопамяти, объединённой в одну вычислительную систему, что даёт запас под крупные языковые модели, KV-cache и большие батчи при многопоточном обслуживании запросов.
В роли центрального процессора выступает Ampere Altra или Altra Max (один сокет LGA4926, до 128 ядер). Платформа рассчитана на обучение и дообучение моделей, продакшн-инференс, RAG-системы и научные расчёты HPC.
Ключевые особенности
- 8× NVIDIA A100 SXM 80GB в составе HGX с памятью HBM2e и масштабированием задач сразу по нескольким ускорителям.
- 640 ГБ совокупной VRAM: в 4-битной квантизации помещаются модели класса DeepSeek-R1 685B и Mistral-Large-3 675B (оценка по объёму около 404–407 ГБ).
- Один процессор Ampere Altra / Altra Max, до 128 ядер.
- Оперативная память DDR4 ECC REG: 16 DIMM, 8-канальная архитектура, до 4 ТБ на процессор, до 3200 МГц.
- Накопители: 6× 2.5" Gen4 U.2 NVMe hot-swap и 4× M.2 NVMe (PCIe Gen4 x4).
- Совокупная производительность восьми A100: 156 TFLOPS в FP64 Tensor Core, 2 496 TFLOPS в TF32, 4 992 TFLOPS в BF16/FP16, 9 984 TOPS в INT8.
Характеристики
| Параметр | Значение |
|---|---|
| Состояние | Новое |
| Форм-фактор | 4U |
| Процессор | Ampere Altra / Altra Max, 1× LGA4926, до 128 ядер |
| Видеокарты | 8× NVIDIA A100 SXM 80GB |
| Общий объём VRAM | 640 ГБ |
| Тип памяти GPU | HBM2e |
| Оперативная память | 4096 ГБ, DDR4 ECC REG, 16 DIMM |
| Накопители | 6× 2.5" Gen4 U.2 NVMe hot-swap, 4× M.2 NVMe (PCIe Gen4 x4) |
| Основные задачи | Обучение, дообучение, инференс, RAG, HPC |
Для каких задач подходит
Сервер подойдёт командам, которые запускают крупные LLM в собственном контуре. По объёму памяти он справляется с квантизированными моделями DeepSeek-R1 685B, GLM-5, GigaChat3.5-432B, Qwen3.5-397B в FP8 и Mistral-Large-3, а также с более лёгкими вариантами вроде gpt-oss:120b, которые можно разместить на 2–4 GPU с запасом под throughput. Для генеративных задач платформа подходит под Stable Diffusion XL, Flux.2-dev и видеомодели Kandinsky, а масштабирование по нескольким GPU позволяет вести параллельную генерацию.
Стоит учитывать, что при очень длинных контекстах и высоком параллелизме основным ограничением становится VRAM (KV-cache и батчи). В самых тяжёлых сценариях может потребоваться более агрессивная квантизация или иная схема параллелизма.
Поставка и гарантия
Оборудование поставляется новым. Перед отправкой «СервакМастер» тестирует сервер, на него действует гарантия 1 год с заменой компонентов, а доставка по России осуществляется СДЭК и другими ведущими службами. Если нужна конфигурация на этой платформе под ваши задачи и бюджет, свяжитесь с менеджером — мы подберём подходящий вариант.
Характеристики
| Тип | Новые |
| Основная задача | Обучение моделей / Инференс / Дообучение моделей / RAG-системы / Анализ данных / Научные расчеты (HPC) |
| Процессор (CPU) | Ampere Altra / Altra Max |
| Видеокарта (GPU) | NVIDIA A100 |
| Количество GPU, шт | 8 |
| Общий объем видеопамяти (VRAM), ГБ | 640 |
| Тип памяти GPU | HBM2e |
| Объем оперативной памяти (RAM), ГБ | 4096 |
| Тип оперативной памяти | DDR4 ECC REG |
| Форм-фактор | 4U |











