Что произошло
5 августа 2026 года AMD вместе с Supermicro и Spectro Cloud представила AMD Instinct Coder — готовый сервер под ИИ-разработку, который ставится в собственную серверную, а не арендуется в облаке. Смысл продукта в экономике: AMD заявляет до 70% экономии совокупной стоимости владения по сравнению с работой на облачных фронтир-моделях и окупаемость вложений «всего за шесть месяцев». Обе цифры — со звёздочкой и без опубликованной методики расчёта.
Детали
Базовая конфигурация выглядит так:Компонент Что стоит Сервер Supermicro AS-8126GS-TNMR Процессоры 2 × AMD EPYC 9575F, по 64 ядра, 3,3 ГГц Ускорители 8 × AMD Instinct MI325X, по 256 ГБ HBM3E Оперативная память 3 ТБ DDR5 (24 планки по 128 ГБ) Сеть 2 × AMD Pensando Pollara 400, 400 Гбит/с Питание 6 блоков по 5250 Вт, схема 3+3
MI325X — карта прошлого поколения; заявлена и поддержка новой серии AMD Instinct MI350. Локально узел крутит открытую модель GLM-5.2, оптимизированную под ускорители AMD. Управляет всем PaletteAI Inference Launchpad от Spectro Cloud: маршрутизатор сначала пробует локальную модель и уходит к облачным Claude, GPT или Gemini, только когда этого требует политика компании или сложность задачи. Расход токенов и сравнение «локально против облака» выводятся в Grafana.
Важная деталь для команд: подключаются привычные инструменты — Claude Code, OpenAI Codex, VS Code и Cursor. Переучивать разработчиков не нужно, меняется только то, что стоит за ними. Один узел рассчитан на 50 пользователей, 30 из них одновременно.
Что это значит
Это предложение не для энтузиаста с домашним сервером, а для компании, которая уже платит за облачные токены и не может выпускать исходный код наружу. Считать выгоду стоит не по обещанным 70%, а по своей команде: единица закупки здесь — узел на 50 разработчиков. Команде из десяти человек он избыточен, и никакая экономия на токенах эту разницу не закроет.
Технически сильная сторона — память: восемь MI325X дают 2 ТБ HBM3E в одном узле, то есть крупные открытые модели помещаются целиком, без разрезания по машинам. Слабая — то, что мозг системы AMD не принадлежит: локально работает сторонняя открытая модель, а на сложных задачах роутер всё равно уходит в облако, и часть счёта возвращается.
Горизонт — не сегодня. Систему показывали на конференции Ai4 в Лас-Вегасе 4–6 августа 2026 года, конфигурация на MI325X пока описана как ожидаемая и проходит финальную валидацию партнёров. Заказ идёт через представителя AMD, публичного прайса нет.


