Supermicro SYS-821GE-TNMR2 — 8U AI-сервер с 8× AMD Instinct MI300X 192GB

Supermicro SYS-821GE-TNMR2: высокоплотный сервер для больших ИИ-моделей

Supermicro SYS-821GE-TNMR2 в этой конфигурации — восьмиграфический сервер формата 8U на базе ускорителей AMD Instinct MI300X OAM по 192 ГБ HBM3 каждый. Платформа рассчитана на двухпроцессорную схему Intel Xeon Scalable 4-го и 5-го поколений и ориентирована на обучение, дообучение и промышленный инференс крупных нейросетей, а также на научные расчёты.

Главное преимущество системы — суммарная видеопамять 1536 ГБ (1,5 ТБ). Такой запас позволяет держать в памяти очень большие модели, длинный контекст и объёмный KV-cache, а также повышать параллельность запросов при работе сервиса в продакшене.

Ключевые особенности

  • 8 ускорителей AMD Instinct MI300X OAM, по 192 ГБ HBM3 на каждый.
  • 1536 ГБ видеопамяти на узел — хватает для полноразмерных LLM без агрессивной квантизации.
  • Два процессора Intel Xeon Scalable 4-го/5-го поколения (LGA-4677).
  • До 8 ТБ оперативной памяти DDR5 ECC RDIMM 4400 MT/s или до 4 ТБ при 5600 MT/s, 32 слота.
  • Дисковая подсистема: 12× 2,5" NVMe, 8× 2,5" SATA, опционально ещё 4× 2,5" NVMe, а также 2× M.2 NVMe (M-key).
  • Совокупная производительность восьми GPU: 10,4 PFLOPS в FP16 и BF16 (20,88 PFLOPS со структурированной разреженностью), 20,88 PFLOPS в FP8 (41,76 PFLOPS с разреженностью), 1304 TFLOPS в FP32.
  • По данным описания, модели вроде DeepSeek-V4-Pro (около 865 ГБ) и GLM-5-FP8 (около 756 ГБ) помещаются на 8 GPU с запасом под контекст.

Характеристики

Параметр Значение
Модель Supermicro SYS-821GE-TNMR2
Форм-фактор 8U
GPU 8× AMD Instinct MI300X OAM 192GB
Видеопамять 1536 ГБ HBM3
Процессор 2× Intel Xeon Scalable 4-го/5-го поколения (LGA-4677)
Оперативная память до 8 ТБ DDR5 ECC RDIMM 4400 MT/s, до 4 ТБ при 5600 MT/s, 32 слота
Накопители 12× 2,5" NVMe + 8× 2,5" SATA + 4× 2,5" NVMe (опционально), 2× M.2 NVMe
Производительность FP16 10,4 PFLOPS (20,88 PFLOPS с разреженностью)
Производительность FP8 20,88 PFLOPS (41,76 PFLOPS с разреженностью)
Состояние Новое

Для каких задач подходит

  • Обучение и дообучение (fine-tuning) больших языковых моделей.
  • Инференс и развёртывание LLM в продакшене с высокой параллельностью запросов.
  • RAG-системы и агентные сценарии с длинным контекстом.
  • Генерация изображений и коротких видео на диффузионных моделях (Stable Diffusion XL, Flux.2-dev и др.): задачи удобно распределять по GPU очередями.
  • Научные расчёты и HPC: 653,6 TFLOPS в FP64 на узел.

Состояние, проверка и гарантия

Сервер поставляется новым. Перед отправкой «СервакМастер» тестирует оборудование, на него действует гарантия 1 год с заменой компонентов. Доставка по России осуществляется СДЭК и другими ведущими службами доставки. Если нужна конфигурация на эту платформу под ваши задачи и бюджет, свяжитесь с менеджером — мы подберём подходящий вариант.

Характеристики

ТипНовые
Основная задачаОбучение моделей / Инференс / Дообучение моделей / RAG-системы / Анализ данных / Научные расчеты (HPC)
Процессор (CPU)Intel Xeon
Видеокарта (GPU)AMD Instinct MI300X
Количество GPU, шт8
Общий объем видеопамяти (VRAM), ГБ1536
Тип памяти GPUHBM3
Объем оперативной памяти (RAM), ГБ8192
Тип оперативной памятиDDR5 ECC REG
Форм-фактор8U
31 660 600 руб.
Под заказ
Задать вопрос
Гарантия с заменой компонентов
Доставка СДЭК и ведущими службами доставки
Помощь в подборе конфигурации
Характеристики
ТипНовые
Основная задачаОбучение моделей / Инференс / Дообучение моделей / RAG-системы / Анализ данных / Научные расчеты (HPC)
Процессор (CPU)Intel Xeon
Видеокарта (GPU)AMD Instinct MI300X
Количество GPU, шт8
Общий объем видеопамяти (VRAM), ГБ1536
Тип памяти GPUHBM3
Объем оперативной памяти (RAM), ГБ8192
Тип оперативной памятиDDR5 ECC REG
Форм-фактор8U

Есть вопросы?

Поможем выбрать, проконсультируем по всем услугам, расскажем о средствах решения ваших задач
Заказать консультацию