GIGABYTE XV23-VC0-AAJ1 — 2U ИИ-сервер: 4× H100 NVL 94GB, 2× Grace, 960GB LPDDR5X

Обзор GIGABYTE XV23-VC0-AAJ1

GIGABYTE XV23-VC0-AAJ1 — компактная 2U-платформа для задач искусственного интеллекта, построенная на связке NVIDIA Grace и ускорителей H100 NVL. В этой конфигурации установлены четыре GPU NVIDIA H100 NVL по 94GB и два процессора Grace, объединённые каналом NVLink-C2C. Всё это умещается в одном стоечном корпусе высотой 2U.

Суммарно система располагает 376GB видеопамяти HBM3 и 960GB оперативной памяти LPDDR5X с ECC. Такого объёма хватает для запуска крупных языковых моделей, работы с длинным контекстом и распределённого инференса на четырёх ускорителях без выхода за пределы одного сервера.

Ключевые особенности

  • Четыре ускорителя NVIDIA H100 NVL 94GB HBM3 в двухслотовом исполнении на слотах PCIe Gen5 x16.
  • Два процессора NVIDIA Grace, связанные NVLink-C2C, и 960GB памяти LPDDR5X ECC.
  • 376GB суммарной видеопамяти: достаточно для моделей класса 70B без квантизации и для более крупных моделей при распределении по четырём GPU.
  • Совокупная производительность четырёх H100 NVL: до 13364 TFLOPS в FP8, 6684 TFLOPS в BF16/FP16, 3340 TFLOPS в TF32, 240 TFLOPS в FP32 и FP64 Tensor Core.
  • Два фронтальных отсека 2.5" NVMe Gen5 с горячей заменой и два слота M.2 PCIe Gen5 x4 (2242/2260/2280/22110) для быстрого хранилища.
  • Плотная компоновка: вся AI-конфигурация собрана в одном корпусе 2U.

Характеристики

Параметр Значение
Платформа GIGABYTE XV23-VC0-AAJ1
Процессор 2× NVIDIA Grace
Видеокарты 4× NVIDIA H100 NVL 94GB HBM3
Общий объём видеопамяти 376 ГБ
Оперативная память 960 ГБ LPDDR5X
Накопители 2× 2.5" Gen5 NVMe, 2× M.2
Форм-фактор 2U
Состояние Новое

Для каких задач подходит

Сервер рассчитан на инференс и развёртывание больших языковых моделей, дообучение, построение RAG-систем, анализ данных и научные расчёты (HPC). По оценкам загрузки памяти, система уверенно держит такие модели, как DeepSeek-R1-Distill-Llama-70B (около 141GB), gpt-oss-120b (около 196GB) и Qwen3.5-122B-A10B (около 250GB), оставляя запас под контекст и параллельные запросы. Модель GLM-4.7-FP8 (около 362GB) занимает почти всю видеопамять, поэтому для неё лучше выбирать умеренный контекст.

Платформа подходит и для генеративных диффузионных моделей: Stable Diffusion 3.5 Medium, FLUX.2-dev, Kandinsky 5.0 для изображений и коротких видео. Нагрузку удобно распределять между четырьмя GPU и запускать несколько процессов одновременно.

Состояние, проверка и поставка

Сервер поставляется новым. Перед отправкой «СервакМастер» тестирует оборудование, на него действует гарантия 1 год с заменой компонентов. Доставка по России осуществляется через СДЭК и другие ведущие службы доставки. Уточнить комплектацию и подобрать конфигурацию под вашу задачу можно у менеджеров магазина.

Характеристики

ТипНовые
Основная задачаОбучение моделей / Инференс / Дообучение моделей / RAG-системы / Анализ данных / Научные расчеты (HPC)
Процессор (CPU)NVIDIA Grace
Видеокарта (GPU)NVIDIA H100
Количество GPU, шт4
Общий объем видеопамяти (VRAM), ГБ376
Тип памяти GPUHBM3
Объем оперативной памяти (RAM), ГБ960
Тип оперативной памятиLPDDR5x
Форм-фактор2U
22 793 100 руб.
Под заказ
Задать вопрос
Гарантия с заменой компонентов
Доставка СДЭК и ведущими службами доставки
Помощь в подборе конфигурации
Характеристики
ТипНовые
Основная задачаОбучение моделей / Инференс / Дообучение моделей / RAG-системы / Анализ данных / Научные расчеты (HPC)
Процессор (CPU)NVIDIA Grace
Видеокарта (GPU)NVIDIA H100
Количество GPU, шт4
Общий объем видеопамяти (VRAM), ГБ376
Тип памяти GPUHBM3
Объем оперативной памяти (RAM), ГБ960
Тип оперативной памятиLPDDR5x
Форм-фактор2U

Есть вопросы?

Поможем выбрать, проконсультируем по всем услугам, расскажем о средствах решения ваших задач
Заказать консультацию