NVIDIA GB300 NVL72: стойка с 72 GPU Blackwell Ultra и 36 процессорами Grace

NVIDIA GB300 NVL72: rack-scale платформа для AI-фабрик

NVIDIA GB300 NVL72 — стоечная система нового поколения, в которой 72 ускорителя Blackwell Ultra и 36 процессоров Grace объединены в единый вычислительный домен. Платформа рассчитана на reasoning-модели, крупные агентные системы и тяжёлые корпоративные AI-нагрузки, где важны не отдельные GPU, а общая память и скорость обмена между ними.

Это решение для AI-фабрик и больших вычислительных центров: оно закрывает обучение, дообучение и промышленный инференс моделей масштаба сотен миллиардов и триллионов параметров. Для классического рендеринга и рабочей визуализации такая система не предназначена.

Ключевые особенности

  • 72 ускорителя NVIDIA Blackwell Ultra и 36 процессоров NVIDIA Grace в одной стойке.
  • Около 20 ТБ видеопамяти HBM3e с пропускной способностью до 576 ТБ/с и 17 ТБ LPDDR5x; суммарно быстрой памяти порядка 37 ТБ.
  • NVLink 5 с совокупной полосой до 130 ТБ/с между GPU — для многомодельного инференса, обучения и работы с очень длинным контекстом.
  • Поддержка форматов FP4, FP6, FP8, FP16/BF16, INT8; оптимизация под vLLM, TensorRT-LLM и SGLang.
  • По сравнению с предыдущим поколением Blackwell: в 1,5 раза больше плотной FP4-производительности и вдвое быстрее attention-слои.
  • Совокупная производительность системы: 1440 PFLOPS в FP4, 720 PFLOPS в FP8, 360 PFLOPS в FP16/BF16.

Характеристики

Параметр Значение
Состояние Новое
Процессор (CPU) NVIDIA GB300 (Grace)
Видеокарта (GPU) NVIDIA GB300 (Blackwell Ultra)
Количество GPU 72
Общий объём видеопамяти (VRAM) 20088 ГБ
Тип памяти GPU HBM3e
Оперативная память (RAM) 17856 ГБ
Тип оперативной памяти LPDDR5x
Форм-фактор 48U

Для каких задач подходит

  • Обучение и дообучение крупных языковых моделей.
  • Промышленный инференс с высоким параллелизмом запросов и длинным контекстом: по описанию поставщика, система запускает модели класса DeepSeek, Mistral Large, GLM, Kimi, MiniMax и gpt-oss:120b с большим запасом под KV-cache.
  • RAG-системы и агентные рабочие процессы.
  • Анализ данных и научные расчёты (HPC).
  • Генерация изображений и видео диффузионными моделями (Stable Diffusion XL, Flux.2-dev, Kandinsky, NVIDIA Cosmos) в больших параллельных очередях.

Состояние, проверка и поставка

Система поставляется в состоянии «Новое». Перед отправкой «СервакМастер» тестирует оборудование, на него действует гарантия 1 год с заменой компонентов. Доставка по России осуществляется СДЭК и другими ведущими службами доставки. Конфигурацию и условия поставки под вашу инфраструктуру можно уточнить у наших специалистов.

Характеристики

ТипНовые
Основная задачаОбучение моделей / Инференс / Дообучение моделей / RAG-системы / Анализ данных / Научные расчеты (HPC) / Визуализация и рендеринг
Процессор (CPU)NVIDIA GB300 (Grace)
Видеокарта (GPU)NVIDIA GB300 (Blackwell Ultra)
Количество GPU, шт72
Общий объем видеопамяти (VRAM), ГБ20088
Тип памяти GPUHBM3e
Объем оперативной памяти (RAM), ГБ17856
Тип оперативной памятиLPDDR5x
Форм-фактор48U
939 955 400 руб.
Под заказ
Задать вопрос
Гарантия с заменой компонентов
Доставка СДЭК и ведущими службами доставки
Помощь в подборе конфигурации
Характеристики
ТипНовые
Основная задачаОбучение моделей / Инференс / Дообучение моделей / RAG-системы / Анализ данных / Научные расчеты (HPC) / Визуализация и рендеринг
Процессор (CPU)NVIDIA GB300 (Grace)
Видеокарта (GPU)NVIDIA GB300 (Blackwell Ultra)
Количество GPU, шт72
Общий объем видеопамяти (VRAM), ГБ20088
Тип памяти GPUHBM3e
Объем оперативной памяти (RAM), ГБ17856
Тип оперативной памятиLPDDR5x
Форм-фактор48U

Есть вопросы?

Поможем выбрать, проконсультируем по всем услугам, расскажем о средствах решения ваших задач
Заказать консультацию