AMD Gorgon Halo: до 20 токенів/с на моделі в 320 млрд параметрів — за замірами AMD

3 хв. читання

Що сталося

5 жовтня AMD оприлюднила перші офіційні бенчмарки Gorgon Halo — так називають лінійку Ryzen AI Max 400, флагман якої Ryzen AI Max+ Pro 495. Цифри з’явилися за два дні до заходу Microsoft 7 жовтня, де чекають запуску пристроїв на NVIDIA RTX Spark, головного конкурента. Водночас AMD заявила, що вже постачила понад 500 тис. «агентних ПК» у 50+ моделях пристроїв.

Деталі

Усі цифри нижче — заміри самої AMD (вересень 2026, платформа Ryzen AI Halo зі 192 ГБ пам’яті, моделі стиснуто до 4 біт):

МодельПараметрів загаломАктивних на токенШвидкість за AMD
GLM 5.3 Flash320 млрд18 млрддо 20 токенів/с
Qwen 3.8 Flash Next~125 млрд5 млрддо 42 токенів/с

Обидві моделі — MoE: на кожен токен працює лише мала частина ваг, тому гігант на 320 млрд узагалі ворушиться на міні-ПК. Кількість активних параметрів наводить Tom’s Hardware.

Другий тест — генеративні моделі в ComfyUI (середовище для генерації зображень) проти Intel Core Ultra X9 388H (система з 64 ГБ). AMD заявляє перевагу від 1,1 до 32,2 раза; крайнє значення Tom’s Hardware вважає викидом — імовірно, модель просто не вмістилася в пам’ять Intel. З RTX Spark AMD не порівнювала: публічних тестів NVIDIA поки немає.

«Агентний ПК» у термінах AMD — комп’ютер, де CPU, GPU і NPU дають змогу тримати ШІ-агентів локально. Масштаб скромний: звичайних ШІ-ноутбуків компанія постачила десятки мільйонів, агентних — пів мільйона.

Що це означає

Новина для тих, хто обирає машину під локальні нейромережі й чекає на RTX Spark. Козир AMD — пам’ять: до 192 ГБ, з яких до 160 ГБ можна віддати графіці, проти 128 ГБ у RTX Spark. У 4-бітному стисненні це моделі на 300+ млрд параметрів, які в 128 ГБ не влізуть — докладно про цей виграш у розборі ноутбука на Ryzen AI Max+ PRO 495.

Слабке місце — швидкість. «До 20 токенів/с» — пік на короткому контексті: з довгим діалогом чи документом швидкість падає. Gorgon Halo — оновлення Strix Halo з тими самими ядрами та +100 МГц. У тестах Tom’s Hardware попередній Ryzen AI Max+ 395 поступався DGX Spark на тому самому чипі, що й у RTX Spark: 56 проти 64 токенів/с на GPT-OSS 120B. Це збігається з нашим порівнянням DGX Spark, Mac Studio і Strix Halo: більше пам’яті — не означає швидше.

Горизонт — найближчі тижні. Після 7 жовтня з’являться незалежні тести обох платформ. Готові машини вже коштують дорого: Minisforum MS-S1 Max-P495 зі 192 ГБ і SSD на 2 ТБ — $7 399 (на 6 жовтня), відвантаження в середині жовтня. Платити стільки під цифри вендора має сенс лише тим, кому критичний саме обсяг пам’яті.

Контекст

Тиждень тому Framework призначила передзамовлення Desktop на цьому ж чипі зі 192 ГБ пам’яті — тоді даних про продуктивність у ШІ-завданнях не було.

Поділитися
Зв'язатися:
Крипто- та data-аналітик, інженер-програміст (факультет комп'ютерних наук ХНУРЕ). В IT з 2008 року: адміністрував корпоративний моніторинг у «Vodafone Україна», сім років розробляв і просував веб-проєкти, п'ять років керував маркетингом на метриках — конверсія, CTR, ROI, LTV.Криптовалютними ринками займаюся з 2021 року: ончейн-метрики, токеноміка, макроекономічні індикатори. Розробив власну data-driven модель аналізу ринку на 30+ метрик. Стек — Python (pandas, NumPy, SciPy, matplotlib), математична статистика та EDA; збір і звірку даних автоматизую AI-агентами.Принцип — «Don't trust, verify»: кожна цифра перевірена за першоджерелом, ключові — щонайменше за двома незалежними; прогнози — лише сценарії з умовами. Теза без даних не публікується.