Supermicro SYS-821GE-TNMR2 — 8U AI-сервер с 8× AMD Instinct MI300X 192GB
Supermicro SYS-821GE-TNMR2: высокоплотный сервер для больших ИИ-моделей
Supermicro SYS-821GE-TNMR2 в этой конфигурации — восьмиграфический сервер формата 8U на базе ускорителей AMD Instinct MI300X OAM по 192 ГБ HBM3 каждый. Платформа рассчитана на двухпроцессорную схему Intel Xeon Scalable 4-го и 5-го поколений и ориентирована на обучение, дообучение и промышленный инференс крупных нейросетей, а также на научные расчёты.
Главное преимущество системы — суммарная видеопамять 1536 ГБ (1,5 ТБ). Такой запас позволяет держать в памяти очень большие модели, длинный контекст и объёмный KV-cache, а также повышать параллельность запросов при работе сервиса в продакшене.
Ключевые особенности
- 8 ускорителей AMD Instinct MI300X OAM, по 192 ГБ HBM3 на каждый.
- 1536 ГБ видеопамяти на узел — хватает для полноразмерных LLM без агрессивной квантизации.
- Два процессора Intel Xeon Scalable 4-го/5-го поколения (LGA-4677).
- До 8 ТБ оперативной памяти DDR5 ECC RDIMM 4400 MT/s или до 4 ТБ при 5600 MT/s, 32 слота.
- Дисковая подсистема: 12× 2,5" NVMe, 8× 2,5" SATA, опционально ещё 4× 2,5" NVMe, а также 2× M.2 NVMe (M-key).
- Совокупная производительность восьми GPU: 10,4 PFLOPS в FP16 и BF16 (20,88 PFLOPS со структурированной разреженностью), 20,88 PFLOPS в FP8 (41,76 PFLOPS с разреженностью), 1304 TFLOPS в FP32.
- По данным описания, модели вроде DeepSeek-V4-Pro (около 865 ГБ) и GLM-5-FP8 (около 756 ГБ) помещаются на 8 GPU с запасом под контекст.
Характеристики
| Параметр | Значение |
|---|---|
| Модель | Supermicro SYS-821GE-TNMR2 |
| Форм-фактор | 8U |
| GPU | 8× AMD Instinct MI300X OAM 192GB |
| Видеопамять | 1536 ГБ HBM3 |
| Процессор | 2× Intel Xeon Scalable 4-го/5-го поколения (LGA-4677) |
| Оперативная память | до 8 ТБ DDR5 ECC RDIMM 4400 MT/s, до 4 ТБ при 5600 MT/s, 32 слота |
| Накопители | 12× 2,5" NVMe + 8× 2,5" SATA + 4× 2,5" NVMe (опционально), 2× M.2 NVMe |
| Производительность FP16 | 10,4 PFLOPS (20,88 PFLOPS с разреженностью) |
| Производительность FP8 | 20,88 PFLOPS (41,76 PFLOPS с разреженностью) |
| Состояние | Новое |
Для каких задач подходит
- Обучение и дообучение (fine-tuning) больших языковых моделей.
- Инференс и развёртывание LLM в продакшене с высокой параллельностью запросов.
- RAG-системы и агентные сценарии с длинным контекстом.
- Генерация изображений и коротких видео на диффузионных моделях (Stable Diffusion XL, Flux.2-dev и др.): задачи удобно распределять по GPU очередями.
- Научные расчёты и HPC: 653,6 TFLOPS в FP64 на узел.
Состояние, проверка и гарантия
Сервер поставляется новым. Перед отправкой «СервакМастер» тестирует оборудование, на него действует гарантия 1 год с заменой компонентов. Доставка по России осуществляется СДЭК и другими ведущими службами доставки. Если нужна конфигурация на эту платформу под ваши задачи и бюджет, свяжитесь с менеджером — мы подберём подходящий вариант.
Характеристики
| Тип | Новые |
| Основная задача | Обучение моделей / Инференс / Дообучение моделей / RAG-системы / Анализ данных / Научные расчеты (HPC) |
| Процессор (CPU) | Intel Xeon |
| Видеокарта (GPU) | AMD Instinct MI300X |
| Количество GPU, шт | 8 |
| Общий объем видеопамяти (VRAM), ГБ | 1536 |
| Тип памяти GPU | HBM3 |
| Объем оперативной памяти (RAM), ГБ | 8192 |
| Тип оперативной памяти | DDR5 ECC REG |
| Форм-фактор | 8U |

