AMD Gorgon Halo: до 20 токенов/с на модели в 320 млрд параметров — по замерам AMD

3 мин. чтения

Что произошло

5 октября AMD опубликовала первые официальные бенчмарки Gorgon Halo — так называют линейку Ryzen AI Max 400, флагман которой Ryzen AI Max+ Pro 495. Цифры вышли за два дня до мероприятия Microsoft 7 октября, где ждут запуска устройств на NVIDIA RTX Spark, главного конкурента. Заодно AMD заявила, что уже поставила более 500 тыс. «агентных ПК» в 50+ моделях устройств.

Детали

Все цифры ниже — замеры самой AMD (сентябрь 2026, платформа Ryzen AI Halo со 192 ГБ памяти, модели сжаты до 4 бит):

МодельПараметров всегоАктивных на токенСкорость по AMD
GLM 5.3 Flash320 млрд18 млрддо 20 токенов/с
Qwen 3.8 Flash Next~125 млрд5 млрддо 42 токенов/с

Обе модели — MoE: на каждый токен работает лишь малая часть весов, поэтому гигант на 320 млрд вообще шевелится на мини-ПК. Число активных параметров приводит Tom’s Hardware.

Второй тест — генеративные модели в ComfyUI (среда для генерации изображений) против Intel Core Ultra X9 388H (система с 64 ГБ). AMD заявляет перевес от 1,1 до 32,2 раза; крайнее значение Tom’s Hardware считает выбросом — вероятно, модель просто не поместилась в память Intel. С RTX Spark AMD не сравнивала: публичных тестов NVIDIA пока нет.

«Агентный ПК» в терминах AMD — компьютер, где CPU, GPU и NPU позволяют держать ИИ-агентов локально. Масштаб скромный: обычных ИИ-ноутбуков компания поставила десятки миллионов, агентных — полмиллиона.

Что это значит

Новость для тех, кто выбирает машину под локальные нейросети и ждёт RTX Spark. Козырь AMD — память: до 192 ГБ, из них до 160 ГБ можно отдать графике, против 128 ГБ у RTX Spark. В 4-битном сжатии это модели на 300+ млрд параметров, которые в 128 ГБ не влезут — подробно про этот выигрыш в разборе ноутбука на Ryzen AI Max+ PRO 495.

Слабое место — скорость. «До 20 токенов/с» — пик на коротком контексте: с длинным диалогом или документом скорость падает. Gorgon Halo — обновление Strix Halo с теми же ядрами и +100 МГц. В тестах Tom’s Hardware прошлый Ryzen AI Max+ 395 уступал DGX Spark на том же чипе, что и в RTX Spark: 56 против 64 токенов/с на GPT-OSS 120B. Это совпадает с нашим сравнением DGX Spark, Mac Studio и Strix Halo: больше памяти — не значит быстрее.

Горизонт — ближайшие недели. После 7 октября появятся независимые тесты обеих платформ. Готовые машины уже стоят дорого: Minisforum MS-S1 Max-P495 со 192 ГБ и SSD на 2 ТБ — $7 399 (на 6 октября), отгрузка в середине октября. Платить столько под цифры вендора разумно только тем, кому критичен именно объём памяти.

Контекст

Неделю назад Framework назначила предзаказ Desktop на этом же чипе со 192 ГБ памяти — тогда о производительности в ИИ-задачах данных не было.

Поделиться
Связаться:
Крипто- и data-аналитик, инженер-программист (факультет компьютерных наук ХНУРЭ). В IT с 2008 года: администрировал корпоративный мониторинг в «Vodafone Украина», семь лет разрабатывал и продвигал веб-проекты, пять лет руководил маркетингом на метриках — конверсия, CTR, ROI, LTV.Криптовалютными рынками занимаюсь с 2021 года: ончейн-метрики, токеномика, макроэкономические индикаторы. Разработал собственную data-driven модель анализа рынка на 30+ метрик. Стек — Python (pandas, NumPy, SciPy, matplotlib), математическая статистика и EDA; сбор и сверку данных автоматизирую AI-агентами.Принцип — «Don't trust, verify»: каждая цифра проверена по первоисточнику, ключевые — минимум по двум независимым; прогнозы — только сценарии с условиями. Тезис без данных не публикуется.