d-Matrix Raptor кладёт DRAM под логику: 100 ТБ/с и 32 ГБ на карту вместо HBM

3 мин. чтения
BYBIT · СПОТ И ФЬЮЧЕРСЫ
Крипта с нуля
Комиссия 0,1%, торги 24/7, старт с $10
Открыть счёт

Что произошло

На конференции Hot Chips 2026, прошедшей 23–24 августа, компания d-Matrix показала ранний кремний ускорителя Raptor. Его идея — отказаться от HBM: вместо памяти, стоящей рядом с вычислительным кристаллом, кристаллы DRAM складывают прямо под ним. Заявленный результат — около 100 ТБ/с пропускной способности при 0,37 пДж на переданный бит.

Детали

ПоказательRaptor (3D-DRAM)HBM4SRAM
Пропускная способность на мм²32,6 ГБ/соколо 1,5 ГБ/сограничена площадью
Энергия на бит ввода-вывода0,3–0,4 пДж2,5–5 пДжоколо 0,05 пДж
Мощность на ГБ/с2,96 мВт40 мВтпримерно вдесятеро хуже HBM
Ёмкость32 ГБ на картузависит от стекаоколо 4 ГБ потолок

Всё упирается в длину пути до памяти: у HBM сигнал идёт сантиметрами через подложку, у Raptor кристаллы соединены «лицом к лицу» с шагом 36 мкм, то есть путь миллиметровый. Отсюда и экономия: на 100 ТБ/с ввод-вывод тратит около 296 Вт. Вычислительный кристалл делает TSMC по нормам N4, партнёр по 3D-упаковке — Alchip. Конфигурация из 72 карт, по расчётам компании, вмещает передовую модель с контекстом в миллион токенов.

Оговорка: цифры пока вендорские, независимых замеров нет, сроков серийного производства d-Matrix не называла.

Что это значит

Касается это всех, кто платит за инференс — от арендаторов облачных GPU до покупателей памяти. Узкое место современных ускорителей на HBM — не арифметика, а подача весов из памяти: генерация токена читает модель целиком, поэтому скорость упирается в пропускную способность, а размер модели — в ёмкость. Именно из-за этого объём памяти определяет, что вообще получится запустить.

Масштаб выигрыша, если цифры подтвердятся: 2,96 мВт на ГБ/с против 40 мВт у HBM4 — это порядок величины по энергии на ту же полосу. При стоимости электричества в дата-центре и текущем дефиците HBM такая разница переводится прямо в цену токена.

Что это не значит: замены HBM завтра не будет. Показан ранний кремний, а не продукт, и 3D-упаковка добавляет свои проблемы — прежде всего отвод тепла, потому что горячий вычислительный кристалл теперь стоит вплотную к памяти, которая перегрева не любит.

Горизонт: следующая точка — заявление о серийном производстве и первые независимые тесты. До них Raptor остаётся ставкой на то, что дефицит HBM продлится достаточно долго, чтобы альтернативу успели довести.

Контекст

Идея обойти HBM носится в отрасли не первый месяц: Qualcomm продвигает свой подход с памятью рядом с вычислением, AMD купила MEXT ради того, чтобы флеш работал как DRAM, а SK hynix и Samsung наращивают слои в самой HBM. Причина у всех одна — память подорожала и стала дефицитом, а спрос на инференс растёт быстрее, чем производство стеков.

Bybit
SpaceX за крипту
Дробные доли · 24/7
Открыть рынок →
Поделиться
Связаться:
Крипто- и data-аналитик, инженер-программист (факультет компьютерных наук ХНУРЭ). В IT с 2008 года: администрировал корпоративный мониторинг в «Vodafone Украина», семь лет разрабатывал и продвигал веб-проекты, пять лет руководил маркетингом на метриках — конверсия, CTR, ROI, LTV.Криптовалютными рынками занимаюсь с 2021 года: ончейн-метрики, токеномика, макроэкономические индикаторы. Разработал собственную data-driven модель анализа рынка на 30+ метрик. Стек — Python (pandas, NumPy, SciPy, matplotlib), математическая статистика и EDA; сбор и сверку данных автоматизирую AI-агентами.Принцип — «Don't trust, verify»: каждая цифра проверена по первоисточнику, ключевые — минимум по двум независимым; прогнозы — только сценарии с условиями. Тезис без данных не публикуется.