Что это за устройство
AMD начала продажи Ryzen AI Halo — компактного компьютера, рассчитанного на локальный запуск языковых моделей без обращения к облаку. Заявленный потолок — модели до 200 миллиардов параметров.
Цена — 3999 долларов, что на 679 долларов ниже прямого конкурента от NVIDIA.
Разберём, за счёт чего это работает и насколько убедительны заявленные преимущества.
Что внутри
В основе — однокристальная система, объединяющая процессор, графику и нейроускоритель:
| Компонент | Характеристики |
|---|---|
| Процессор | 16 ядер Zen 5, 32 потока |
| Графика | Radeon 8060S, 40 блоков RDNA 3.5 |
| Нейроускоритель | XDNA 2, 50 TOPS |
| Суммарная ИИ-производительность | 126 TOPS |
| Память | 128 ГБ LPDDR5X-8000, унифицированная |
| Накопитель | NVMe PCIe Gen4, 2 ТБ |
Габариты — примерно 15 × 15 × 4,5 см, то есть меньше типичного компактного настольного компьютера. При этом на борту три порта USB Type-C, Wi-Fi 7, Bluetooth 5.4, сетевой интерфейс на 10 Гбит/с и HDMI 2.1b.
Ключевое — унифицированная память
Главная характеристика здесь не мощность, а те самые 128 гигабайт, общие для процессора и графики.
В классической схеме видеокарта имеет собственную память, и модель должна поместиться именно в неё. Видеокарта с 24 ГБ означает потолок примерно в 30 миллиардов параметров при разумном квантовании — дальше начинается подкачка с катастрофическим падением скорости.
Здесь память общая, и модели доступен весь объём. Отсюда и заявленные 200 миллиардов параметров — цифра, для которой в классической конфигурации потребовалось бы несколько ускорителей высокого класса.
Плата за это — пропускная способность. LPDDR5X уступает специализированной видеопамяти, и на моделях, которые поместились бы в обычную видеокарту, та окажется быстрее. Устройство выигрывает там, где модель в видеокарту не помещается вовсе.
Программная часть
Работает открытый стек AMD актуальной версии. Заявлена поддержка с первого дня для распространённых локальных моделей и совместимость с популярными инструментами запуска и разработки.
Открытость стека здесь практическое преимущество: поддержку новых моделей добавляет сообщество, не дожидаясь официальных обновлений.
Стоит помнить и об ограничении: экосистема вокруг решений AMD объективно менее зрелая, чем у конкурента. Часть проектов оптимизирована в первую очередь под чужую платформу, и на новых моделях возможна задержка с поддержкой.
Сравнение с конкурентами
AMD публикует прямое сравнение скорости генерации с ближайшим конкурентом:
| Модель | Преимущество |
|---|---|
| GPT-OSS 120B | +7% |
| Qwen 3.5 122B | +12% |
| Qwen 3.6 35B | +4% |
| GLM 4.7 30B | +14% |
Разрыв невелик — от 4 до 14 процентов. С учётом того, что цифры получены самим производителем на выбранных моделях, корректнее говорить о примерном паритете, чем о превосходстве.
Более весомый аргумент — цена ниже на 679 долларов при вдвое большем объёме памяти, чем у сопоставимых компактных решений других производителей.
Расчёт окупаемости
AMD приводит сравнение с облачными сервисами:
- потребление около 150 Вт при круглосуточной работе — примерно 16 долларов в месяц на электроэнергию;
- сопоставимый объём вычислений в облаке — около 750 долларов в месяц;
- на трёхлетнем горизонте: около 4580 долларов против 27 000.
Заявленная окупаемость — примерно полгода.
К расчёту стоит отнестись критически. Он верен при условии постоянной круглосуточной загрузки. Если устройство работает несколько часов в день, срок окупаемости растягивается кратно, а облачная оплата по факту использования может оказаться выгоднее.
Честный способ посчитать: оцените реальные часы работы в месяц, умножьте на облачную ставку и сравните с 4000 долларов единовременно. Для команды с постоянной нагрузкой расчёт AMD близок к правде. Для эпизодического использования — нет.
Кому подходит
Разработчикам ИИ-приложений — локальная отладка без оплаты каждого запроса и без ограничений по частоте обращений.
Организациям с требованиями к данным — обработка внутри контура без передачи во внешние сервисы.
Тем, кому нужны крупные модели — 128 ГБ позволяют работать с тем, что не помещается в обычную видеокарту.
Кому не подходит: при эпизодическом использовании, при работе с моделями, которые и так помещаются в видеокарту среднего класса, и при необходимости максимальной скорости — специализированный ускоритель на подходящей модели будет быстрее.
Коротко
Ryzen AI Halo интересен не производительностью, а объёмом доступной модели памяти: 128 ГБ общей памяти открывают модели, недоступные обычным видеокартам.
Преимущество над прямым конкурентом в скорости невелико — 4–14% по данным производителя. Реальные аргументы — цена и объём памяти.
Расчёт окупаемости за полгода верен только при круглосуточной загрузке. Считайте по своим реальным часам работы.
Планируете локальный запуск моделей и сравниваете варианты — опишите, что собираетесь запускать, поможем сопоставить компактные решения с серверными.
