Сервер Huawei Atlas 800I A2 для инференса: 8× Ascend 910B 64GB, 4× Kunpeng 920, RAM 512GB
Huawei Atlas 800I A2 — платформа для промышленного инференса больших моделей
Atlas 800I A2 — стоечный сервер высотой 4U, который Huawei позиционирует как инференс-платформу для крупных генеративных моделей в центрах обработки данных и облаках. Внутри четыре процессора Kunpeng 920 и восемь NPU Ascend 910B Reasoning, каждый из которых несёт 64 ГБ памяти HBM.
Суммарно ускорители дают 512 ГБ памяти HBM с пропускной способностью до 1,6 ТБ/с. Такой объём позволяет размещать на одном узле очень крупные LLM, в том числе в квантизированном виде, а также держать рядом большие индексы для RAG и несколько параллельных инстансов сервиса.
Ключевые особенности
- 8 NPU Ascend 910B Reasoning: совокупно 2,24 PFLOPS в FP16 и 4,48 POPS в INT8.
- 512 ГБ HBM на ускорителях (по 64 ГБ на каждый NPU).
- 4 процессора Kunpeng 920 (64 ядра / 64 потока, 2,6 ГГц, 180 Вт).
- 512 ГБ оперативной памяти DDR4 ECC REG; платформа поддерживает до 32 модулей DDR4-3200 и расширение до 2 ТБ.
- Локальное хранилище: варианты до 10×2,5″ SATA/NVMe с RAID 0/1/5/6/10/50/60.
- Сеть: восемь портов 200GE QSFP с поддержкой RoCE для связности кластера.
- До трёх слотов PCIe 4.0 под сетевые карты и специализированные адаптеры.
- Программный стек: Huawei CANN, MindSpore, torch-npu для PyTorch; для сервинга LLM поддерживается vLLM-Ascend.
Характеристики
| Параметр | Значение |
|---|---|
| Состояние | Новое |
| Форм-фактор | 4U |
| Процессор | 4× Kunpeng 920 (64c/64t, 2,6 ГГц, 180 Вт) |
| Ускорители | 8× Ascend 910B Reasoning |
| Видеопамять | 512 ГБ HBM (8 × 64 ГБ) |
| Производительность FP16 | 2,24 PFLOPS |
| Производительность INT8 | 4,48 POPS |
| Оперативная память | 512 ГБ DDR4 ECC REG (до 2 ТБ) |
| Сеть | 8× 200GE QSFP, RoCE |
| Расширение | до 3 слотов PCIe 4.0 |
Для каких задач подходит
Сервер рассчитан на инференс и развёртывание языковых моделей, RAG-системы, reasoning-модели, анализ данных и генерацию изображений и видео при наличии сборок фреймворков под Ascend. По описанию производителя, в конфигурации с 512 ГБ HBM возможен продакшн-инференс моделей уровня DeepSeek-R1 671B в квантизации Q4_K_M (порядка 404 ГБ), а также моделей среднего класса вроде gpt-oss-120b с большим запасом памяти под несколько инстансов. Среди диффузионных моделей указаны Stable Diffusion 3 Medium, FLUX.2-dev, Stable Video Diffusion 1.1 и Kandinsky 5.0.
Важно учитывать ограничения: платформа ориентирована на экосистему Ascend, а не на CUDA или ROCm. Она не предназначена для GPU-графики и классического FP64-ориентированного HPC, а часть инструментов, завязанных на CUDA и TensorRT, потребует портирования или Ascend-специфичных аналогов.
Состояние, проверка и поставка
Сервер поставляется новым. Перед отправкой «СервакМастер» тестирует оборудование; на него действует гарантия 1 год с заменой компонентов. Отправляем по России СДЭК и другими ведущими службами доставки.
Характеристики
| Тип | Новые |
| Основная задача | Инференс / RAG-системы / Анализ данных / Научные расчеты (HPC) |
| Процессор (CPU) | Kunpeng 920 |
| Видеокарта (GPU) | Ascend 910B |
| Количество GPU, шт | 8 |
| Общий объем видеопамяти (VRAM), ГБ | 512 |
| Тип памяти GPU | HBM |
| Объем оперативной памяти (RAM), ГБ | 512 |
| Тип оперативной памяти | DDR4 ECC REG |
| Форм-фактор | 4U |





