GPU-сервер Supermicro SYS-221GE-NR с 4x NVIDIA H100 NVL 94GB HBM3, 2U
Обзор: GPU-сервер Supermicro SYS-221GE-NR для задач ИИ уровня дата-центра
Supermicro SYS-221GE-NR в этой конфигурации несёт четыре ускорителя NVIDIA H100 NVL с 94 ГБ памяти HBM3 каждый, в сумме 376 ГБ видеопамяти. Это узел в корпусе 2U, рассчитанный на длительную нагрузку, где важны плотность вычислений и высокая пропускная способность памяти.
Ускорители построены на архитектуре Hopper и поддерживают форматы FP16, FP8 и INT8. Большой объём HBM3 позволяет запускать крупные модели с более щадящей квантизацией, длинным контекстом, большим размером батча и несколькими параллельными пайплайнами, не экономя каждый гигабайт видеопамяти. Платформа работает с экосистемой CUDA, PyTorch, TensorRT, vLLM и другими современными AI-фреймворками.
Ключевые особенности
- 4x NVIDIA H100 NVL 94GB, суммарно 376 ГБ видеопамяти HBM3.
- Два процессора Intel Xeon Scalable 4-го и 5-го поколений в сокетах LGA 4677.
- 32 слота DIMM, оперативная память DDR5 ECC RDIMM объёмом до 8 ТБ.
- Накопители: 8 отсеков E1.S NVMe и 2 слота M.2 NVMe/SATA (M-key).
- Совокупная пиковая производительность четырёх GPU: FP8 Tensor Core 13 364 TFLOPS, BF16/FP16 Tensor Core 6 684 TFLOPS, INT8 Tensor Core 9 984 TOPS.
- Компактный форм-фактор 2U для установки в стойку.
Характеристики
| Параметр | Значение |
|---|---|
| Платформа | Supermicro SYS-221GE-NR |
| Состояние | Новое |
| Видеокарты | 4x NVIDIA H100 NVL 94GB HBM3 |
| Общий объём видеопамяти | 376 ГБ |
| Процессоры | 2x Intel Xeon Scalable 4-го и 5-го поколений, сокет LGA 4677 |
| Оперативная память | 32 DIMM, до 8 ТБ DDR5 ECC RDIMM |
| Накопители | 8x E1.S NVMe, 2x M.2 NVMe/SATA (M-key) |
| Форм-фактор | 2U |
| FP64 Tensor Core (4 GPU) | 240 TFLOPS |
| FP32 Tensor Core (4 GPU) | 3 340 TFLOPS |
Для каких задач подходит
Сервер ориентирован на обучение и дообучение больших языковых моделей, промышленный инференс, RAG-системы, анализ данных и научные расчёты (HPC). По описанию поставщика, при такой памяти на узле можно разместить DeepSeek-R1-Distill-Llama-70B (около 141 ГБ), Qwen3-235B-A22B-Thinking-2507-FP8 (около 236 ГБ) и gpt-oss:120b в FP16 (около 260 ГБ). Mistral-Large-3-675B в квантизации IQ4_XS (около 360 ГБ) и GLM-4.7-FP8 (около 362 ГБ) запускаются на пределе по памяти: потребуется аккуратная настройка контекста, батча и KV-cache.
Платформа подходит и для диффузионных моделей, включая Stable Diffusion XL 1.0, FLUX.2-dev, SD Turbo и Kandinsky 5.0 для изображений и коротких видео. Задания удобно распределять по нескольким GPU и держать очередь параллельных задач.
Состояние, проверка и поставка
Оборудование поставляется новым. Перед отправкой «СервакМастер» тестирует систему, на неё действует гарантия 1 год с заменой компонентов. Доставка по России осуществляется СДЭК и другими ведущими службами доставки. Консультацию по конфигурации и совместимости с вашими задачами можно получить у специалистов магазина.
Характеристики
| Тип | Новые |
| Основная задача | Обучение моделей / Инференс / Дообучение моделей / RAG-системы / Анализ данных / Научные расчеты (HPC) |
| Процессор (CPU) | Intel Xeon |
| Видеокарта (GPU) | NVIDIA H100 |
| Количество GPU, шт | 4 |
| Общий объем видеопамяти (VRAM), ГБ | 376 |
| Тип памяти GPU | HBM3 |
| Объем оперативной памяти (RAM), ГБ | 8192 |
| Тип оперативной памяти | DDR5 ECC REG |
| Форм-фактор | 2U |

