XCENA MX1 на Hot Chips 2026: до 2 ТБ DDR5 по CXL и 3072 ядра RISC-V рядом с памятью

4 мин. чтения
BYBIT · СПОТ И ФЬЮЧЕРСЫ
Крипта с нуля
Комиссия 0,1%, торги 24/7, старт с $10
Открыть счёт

Что произошло

26 августа 2026 года корейская XCENA представила на конференции Hot Chips 2026 архитектуру и замеры своего чипа MX1 — «вычислительной памяти» на шине CXL. CXL (Compute Express Link) — это стандарт, который позволяет подключать к серверу дополнительную память через слот PCIe, как видеокарту. MX1 объединяет в одном устройстве три вещи: до 2 ТБ DDR5, SSD в роли медленной памяти и 3072 маленьких ядра RISC-V, которые обрабатывают данные прямо там, где те лежат. Массовое производство компания планирует до конца 2026 года, первую выручку — в 2027-м.

Детали

ПараметрЗначение
ИнтерфейсCXL 3.2 поверх PCIe 6.0, устройство CXL Type 3
Памятьдо 2 ТБ DDR5-8400, четыре канала
Ядра3072 in-order RISC-V (24 подсистемы по 128 ядер), техпроцесс Samsung 4 нм
Векторные блокиоколо 3 TFLOPS FP32/FP16 на скалярных произведениях
SSD-ярусInfiniteMemory: SSD виден как байт-адресуемая память, горячие страницы по 64 КБ кэшируются в DRAM
Замер на шести аналитических ядрахдо 4,7× пропускной способности и 18,7× энергоэффективности против CPU, читающего данные по CXL; до 2,0× и 6,2× против того же CPU с локальной DDR5

Базой для сравнения служил Intel Xeon 6767P. Отдельно XCENA показала работу с KV-кэшем — промежуточной памятью, которую языковая модель накапливает по ходу диалога: на Llama 3.1 8B с vLLM время до первого токена при чтении кэша из MX1 составило 1,13× от варианта с DRAM сервера, а при чтении с «голого» SSD — 1,86×.

Самая заметная часть доклада — стойка, собранная вместе с Samsung (коммутатор CXL Liqid, видеокарты NVIDIA RTX Pro 6000 Blackwell, целевые 20 ТБ и 2,7 ТБ/с). На векторном поиске по индексу FAISS из 512 млн векторов десять MX1 дали 64× запросов в секунду против CPU с пулом CXL-памяти, а на Llama 3.1 70B (INT8, контекст 100 тыс. токенов) два сервера по пять MX1 подняли скорость генерации с 5,5 до 17,7 токена в секунду — в 3,35 раза.

Что это значит

Касается это тех, кто держит серверы для инференса и RAG — поиска по собственной базе документов перед ответом модели. Узкое место таких систем не вычисления, а память: HBM на видеокарте дорогая и её мало, а когда контекст и векторные индексы туда не влезают, данные гоняют через CPU. MX1 предлагает третий ярус между HBM и SSD, где дешёвая DDR5 и ядра рядом с ней берут на себя поиск, фильтрацию и подготовку данных.

Оговорки важнее рекордов. Все замеры сделала сама XCENA на своих нагрузках; независимых тестов нет, а кратные цифры вроде 64× получены против CPU, которому специально дали читать данные по медленному CXL. Плюс код под MX1 пишется отдельно, на C/C++ или Rust, а поддержку PyTorch и векторных баз компания только достраивает.

Горизонт для практика: полгода до серийных образцов и минимум год до того, как такие карты появятся у облачных провайдеров. Главный сигнал — подхватит ли идею Samsung как производитель памяти.

Контекст

XCENA основана выходцами из Samsung Electronics и SK hynix, штаб-квартира — в Южной Корее, офис — в Калифорнии. К августу 2026 года компания привлекла $185 млн, включая раунд B на $135 млн. Линейку MX1 она впервые показала в августе 2025 года; тогда речь шла о 1 ТБ на устройство.

BYBIT COPY TRADING
Копируй профи
Bybit повторит сделки трейдера за тебя
Начать
Поделиться
Связаться:
Крипто- и data-аналитик, инженер-программист (факультет компьютерных наук ХНУРЭ). В IT с 2008 года: администрировал корпоративный мониторинг в «Vodafone Украина», семь лет разрабатывал и продвигал веб-проекты, пять лет руководил маркетингом на метриках — конверсия, CTR, ROI, LTV.Криптовалютными рынками занимаюсь с 2021 года: ончейн-метрики, токеномика, макроэкономические индикаторы. Разработал собственную data-driven модель анализа рынка на 30+ метрик. Стек — Python (pandas, NumPy, SciPy, matplotlib), математическая статистика и EDA; сбор и сверку данных автоматизирую AI-агентами.Принцип — «Don't trust, verify»: каждая цифра проверена по первоисточнику, ключевые — минимум по двум независимым; прогнозы — только сценарии с условиями. Тезис без данных не публикуется.