Что это за устройство

AMD начала продажи Ryzen AI Halo — компактного компьютера, рассчитанного на локальный запуск языковых моделей без обращения к облаку. Заявленный потолок — модели до 200 миллиардов параметров.

Цена — 3999 долларов, что на 679 долларов ниже прямого конкурента от NVIDIA.

Разберём, за счёт чего это работает и насколько убедительны заявленные преимущества.

Что внутри

В основе — однокристальная система, объединяющая процессор, графику и нейроускоритель:

Компонент Характеристики
Процессор 16 ядер Zen 5, 32 потока
Графика Radeon 8060S, 40 блоков RDNA 3.5
Нейроускоритель XDNA 2, 50 TOPS
Суммарная ИИ-производительность 126 TOPS
Память 128 ГБ LPDDR5X-8000, унифицированная
Накопитель NVMe PCIe Gen4, 2 ТБ

Габариты — примерно 15 × 15 × 4,5 см, то есть меньше типичного компактного настольного компьютера. При этом на борту три порта USB Type-C, Wi-Fi 7, Bluetooth 5.4, сетевой интерфейс на 10 Гбит/с и HDMI 2.1b.

Ключевое — унифицированная память

Главная характеристика здесь не мощность, а те самые 128 гигабайт, общие для процессора и графики.

В классической схеме видеокарта имеет собственную память, и модель должна поместиться именно в неё. Видеокарта с 24 ГБ означает потолок примерно в 30 миллиардов параметров при разумном квантовании — дальше начинается подкачка с катастрофическим падением скорости.

Здесь память общая, и модели доступен весь объём. Отсюда и заявленные 200 миллиардов параметров — цифра, для которой в классической конфигурации потребовалось бы несколько ускорителей высокого класса.

Плата за это — пропускная способность. LPDDR5X уступает специализированной видеопамяти, и на моделях, которые поместились бы в обычную видеокарту, та окажется быстрее. Устройство выигрывает там, где модель в видеокарту не помещается вовсе.

Программная часть

Работает открытый стек AMD актуальной версии. Заявлена поддержка с первого дня для распространённых локальных моделей и совместимость с популярными инструментами запуска и разработки.

Открытость стека здесь практическое преимущество: поддержку новых моделей добавляет сообщество, не дожидаясь официальных обновлений.

Стоит помнить и об ограничении: экосистема вокруг решений AMD объективно менее зрелая, чем у конкурента. Часть проектов оптимизирована в первую очередь под чужую платформу, и на новых моделях возможна задержка с поддержкой.

Сравнение с конкурентами

AMD публикует прямое сравнение скорости генерации с ближайшим конкурентом:

Модель Преимущество
GPT-OSS 120B +7%
Qwen 3.5 122B +12%
Qwen 3.6 35B +4%
GLM 4.7 30B +14%

Разрыв невелик — от 4 до 14 процентов. С учётом того, что цифры получены самим производителем на выбранных моделях, корректнее говорить о примерном паритете, чем о превосходстве.

Более весомый аргумент — цена ниже на 679 долларов при вдвое большем объёме памяти, чем у сопоставимых компактных решений других производителей.

Расчёт окупаемости

AMD приводит сравнение с облачными сервисами:

  • потребление около 150 Вт при круглосуточной работе — примерно 16 долларов в месяц на электроэнергию;
  • сопоставимый объём вычислений в облаке — около 750 долларов в месяц;
  • на трёхлетнем горизонте: около 4580 долларов против 27 000.

Заявленная окупаемость — примерно полгода.

К расчёту стоит отнестись критически. Он верен при условии постоянной круглосуточной загрузки. Если устройство работает несколько часов в день, срок окупаемости растягивается кратно, а облачная оплата по факту использования может оказаться выгоднее.

Честный способ посчитать: оцените реальные часы работы в месяц, умножьте на облачную ставку и сравните с 4000 долларов единовременно. Для команды с постоянной нагрузкой расчёт AMD близок к правде. Для эпизодического использования — нет.

Кому подходит

Разработчикам ИИ-приложений — локальная отладка без оплаты каждого запроса и без ограничений по частоте обращений.

Организациям с требованиями к данным — обработка внутри контура без передачи во внешние сервисы.

Тем, кому нужны крупные модели — 128 ГБ позволяют работать с тем, что не помещается в обычную видеокарту.

Кому не подходит: при эпизодическом использовании, при работе с моделями, которые и так помещаются в видеокарту среднего класса, и при необходимости максимальной скорости — специализированный ускоритель на подходящей модели будет быстрее.

Коротко

Ryzen AI Halo интересен не производительностью, а объёмом доступной модели памяти: 128 ГБ общей памяти открывают модели, недоступные обычным видеокартам.

Преимущество над прямым конкурентом в скорости невелико — 4–14% по данным производителя. Реальные аргументы — цена и объём памяти.

Расчёт окупаемости за полгода верен только при круглосуточной загрузке. Считайте по своим реальным часам работы.

Планируете локальный запуск моделей и сравниваете варианты — опишите, что собираетесь запускать, поможем сопоставить компактные решения с серверными.