GIGABYTE XV23-VC0-AAJ1 — 2U ИИ-сервер: 4× H100 NVL 94GB, 2× Grace, 960GB LPDDR5X
Обзор GIGABYTE XV23-VC0-AAJ1
GIGABYTE XV23-VC0-AAJ1 — компактная 2U-платформа для задач искусственного интеллекта, построенная на связке NVIDIA Grace и ускорителей H100 NVL. В этой конфигурации установлены четыре GPU NVIDIA H100 NVL по 94GB и два процессора Grace, объединённые каналом NVLink-C2C. Всё это умещается в одном стоечном корпусе высотой 2U.
Суммарно система располагает 376GB видеопамяти HBM3 и 960GB оперативной памяти LPDDR5X с ECC. Такого объёма хватает для запуска крупных языковых моделей, работы с длинным контекстом и распределённого инференса на четырёх ускорителях без выхода за пределы одного сервера.
Ключевые особенности
- Четыре ускорителя NVIDIA H100 NVL 94GB HBM3 в двухслотовом исполнении на слотах PCIe Gen5 x16.
- Два процессора NVIDIA Grace, связанные NVLink-C2C, и 960GB памяти LPDDR5X ECC.
- 376GB суммарной видеопамяти: достаточно для моделей класса 70B без квантизации и для более крупных моделей при распределении по четырём GPU.
- Совокупная производительность четырёх H100 NVL: до 13364 TFLOPS в FP8, 6684 TFLOPS в BF16/FP16, 3340 TFLOPS в TF32, 240 TFLOPS в FP32 и FP64 Tensor Core.
- Два фронтальных отсека 2.5" NVMe Gen5 с горячей заменой и два слота M.2 PCIe Gen5 x4 (2242/2260/2280/22110) для быстрого хранилища.
- Плотная компоновка: вся AI-конфигурация собрана в одном корпусе 2U.
Характеристики
| Параметр | Значение |
|---|---|
| Платформа | GIGABYTE XV23-VC0-AAJ1 |
| Процессор | 2× NVIDIA Grace |
| Видеокарты | 4× NVIDIA H100 NVL 94GB HBM3 |
| Общий объём видеопамяти | 376 ГБ |
| Оперативная память | 960 ГБ LPDDR5X |
| Накопители | 2× 2.5" Gen5 NVMe, 2× M.2 |
| Форм-фактор | 2U |
| Состояние | Новое |
Для каких задач подходит
Сервер рассчитан на инференс и развёртывание больших языковых моделей, дообучение, построение RAG-систем, анализ данных и научные расчёты (HPC). По оценкам загрузки памяти, система уверенно держит такие модели, как DeepSeek-R1-Distill-Llama-70B (около 141GB), gpt-oss-120b (около 196GB) и Qwen3.5-122B-A10B (около 250GB), оставляя запас под контекст и параллельные запросы. Модель GLM-4.7-FP8 (около 362GB) занимает почти всю видеопамять, поэтому для неё лучше выбирать умеренный контекст.
Платформа подходит и для генеративных диффузионных моделей: Stable Diffusion 3.5 Medium, FLUX.2-dev, Kandinsky 5.0 для изображений и коротких видео. Нагрузку удобно распределять между четырьмя GPU и запускать несколько процессов одновременно.
Состояние, проверка и поставка
Сервер поставляется новым. Перед отправкой «СервакМастер» тестирует оборудование, на него действует гарантия 1 год с заменой компонентов. Доставка по России осуществляется через СДЭК и другие ведущие службы доставки. Уточнить комплектацию и подобрать конфигурацию под вашу задачу можно у менеджеров магазина.
Характеристики
| Тип | Новые |
| Основная задача | Обучение моделей / Инференс / Дообучение моделей / RAG-системы / Анализ данных / Научные расчеты (HPC) |
| Процессор (CPU) | NVIDIA Grace |
| Видеокарта (GPU) | NVIDIA H100 |
| Количество GPU, шт | 4 |
| Общий объем видеопамяти (VRAM), ГБ | 376 |
| Тип памяти GPU | HBM3 |
| Объем оперативной памяти (RAM), ГБ | 960 |
| Тип оперативной памяти | LPDDR5x |
| Форм-фактор | 2U |









