Сервер Huawei Atlas 800I A2 для инференса: 8× Ascend 910B 64GB, 4× Kunpeng 920, RAM 512GB

Huawei Atlas 800I A2 — платформа для промышленного инференса больших моделей

Atlas 800I A2 — стоечный сервер высотой 4U, который Huawei позиционирует как инференс-платформу для крупных генеративных моделей в центрах обработки данных и облаках. Внутри четыре процессора Kunpeng 920 и восемь NPU Ascend 910B Reasoning, каждый из которых несёт 64 ГБ памяти HBM.

Суммарно ускорители дают 512 ГБ памяти HBM с пропускной способностью до 1,6 ТБ/с. Такой объём позволяет размещать на одном узле очень крупные LLM, в том числе в квантизированном виде, а также держать рядом большие индексы для RAG и несколько параллельных инстансов сервиса.

Ключевые особенности

  • 8 NPU Ascend 910B Reasoning: совокупно 2,24 PFLOPS в FP16 и 4,48 POPS в INT8.
  • 512 ГБ HBM на ускорителях (по 64 ГБ на каждый NPU).
  • 4 процессора Kunpeng 920 (64 ядра / 64 потока, 2,6 ГГц, 180 Вт).
  • 512 ГБ оперативной памяти DDR4 ECC REG; платформа поддерживает до 32 модулей DDR4-3200 и расширение до 2 ТБ.
  • Локальное хранилище: варианты до 10×2,5″ SATA/NVMe с RAID 0/1/5/6/10/50/60.
  • Сеть: восемь портов 200GE QSFP с поддержкой RoCE для связности кластера.
  • До трёх слотов PCIe 4.0 под сетевые карты и специализированные адаптеры.
  • Программный стек: Huawei CANN, MindSpore, torch-npu для PyTorch; для сервинга LLM поддерживается vLLM-Ascend.

Характеристики

Параметр Значение
Состояние Новое
Форм-фактор 4U
Процессор 4× Kunpeng 920 (64c/64t, 2,6 ГГц, 180 Вт)
Ускорители 8× Ascend 910B Reasoning
Видеопамять 512 ГБ HBM (8 × 64 ГБ)
Производительность FP16 2,24 PFLOPS
Производительность INT8 4,48 POPS
Оперативная память 512 ГБ DDR4 ECC REG (до 2 ТБ)
Сеть 8× 200GE QSFP, RoCE
Расширение до 3 слотов PCIe 4.0

Для каких задач подходит

Сервер рассчитан на инференс и развёртывание языковых моделей, RAG-системы, reasoning-модели, анализ данных и генерацию изображений и видео при наличии сборок фреймворков под Ascend. По описанию производителя, в конфигурации с 512 ГБ HBM возможен продакшн-инференс моделей уровня DeepSeek-R1 671B в квантизации Q4_K_M (порядка 404 ГБ), а также моделей среднего класса вроде gpt-oss-120b с большим запасом памяти под несколько инстансов. Среди диффузионных моделей указаны Stable Diffusion 3 Medium, FLUX.2-dev, Stable Video Diffusion 1.1 и Kandinsky 5.0.

Важно учитывать ограничения: платформа ориентирована на экосистему Ascend, а не на CUDA или ROCm. Она не предназначена для GPU-графики и классического FP64-ориентированного HPC, а часть инструментов, завязанных на CUDA и TensorRT, потребует портирования или Ascend-специфичных аналогов.

Состояние, проверка и поставка

Сервер поставляется новым. Перед отправкой «СервакМастер» тестирует оборудование; на него действует гарантия 1 год с заменой компонентов. Отправляем по России СДЭК и другими ведущими службами доставки.

Характеристики

ТипНовые
Основная задачаИнференс / RAG-системы / Анализ данных / Научные расчеты (HPC)
Процессор (CPU)Kunpeng 920
Видеокарта (GPU)Ascend 910B
Количество GPU, шт8
Общий объем видеопамяти (VRAM), ГБ512
Тип памяти GPUHBM
Объем оперативной памяти (RAM), ГБ512
Тип оперативной памятиDDR4 ECC REG
Форм-фактор4U
21 636 000 руб.
Под заказ
Задать вопрос
Гарантия с заменой компонентов
Доставка СДЭК и ведущими службами доставки
Помощь в подборе конфигурации
Характеристики
ТипНовые
Основная задачаИнференс / RAG-системы / Анализ данных / Научные расчеты (HPC)
Процессор (CPU)Kunpeng 920
Видеокарта (GPU)Ascend 910B
Количество GPU, шт8
Общий объем видеопамяти (VRAM), ГБ512
Тип памяти GPUHBM
Объем оперативной памяти (RAM), ГБ512
Тип оперативной памятиDDR4 ECC REG
Форм-фактор4U

Есть вопросы?

Поможем выбрать, проконсультируем по всем услугам, расскажем о средствах решения ваших задач
Заказать консультацию