Что произошло
26 августа 2026 года корейская XCENA представила на конференции Hot Chips 2026 архитектуру и замеры своего чипа MX1 — «вычислительной памяти» на шине CXL. CXL (Compute Express Link) — это стандарт, который позволяет подключать к серверу дополнительную память через слот PCIe, как видеокарту. MX1 объединяет в одном устройстве три вещи: до 2 ТБ DDR5, SSD в роли медленной памяти и 3072 маленьких ядра RISC-V, которые обрабатывают данные прямо там, где те лежат. Массовое производство компания планирует до конца 2026 года, первую выручку — в 2027-м.
Детали
| Параметр | Значение |
|---|---|
| Интерфейс | CXL 3.2 поверх PCIe 6.0, устройство CXL Type 3 |
| Память | до 2 ТБ DDR5-8400, четыре канала |
| Ядра | 3072 in-order RISC-V (24 подсистемы по 128 ядер), техпроцесс Samsung 4 нм |
| Векторные блоки | около 3 TFLOPS FP32/FP16 на скалярных произведениях |
| SSD-ярус | InfiniteMemory: SSD виден как байт-адресуемая память, горячие страницы по 64 КБ кэшируются в DRAM |
| Замер на шести аналитических ядрах | до 4,7× пропускной способности и 18,7× энергоэффективности против CPU, читающего данные по CXL; до 2,0× и 6,2× против того же CPU с локальной DDR5 |
Базой для сравнения служил Intel Xeon 6767P. Отдельно XCENA показала работу с KV-кэшем — промежуточной памятью, которую языковая модель накапливает по ходу диалога: на Llama 3.1 8B с vLLM время до первого токена при чтении кэша из MX1 составило 1,13× от варианта с DRAM сервера, а при чтении с «голого» SSD — 1,86×.
Самая заметная часть доклада — стойка, собранная вместе с Samsung (коммутатор CXL Liqid, видеокарты NVIDIA RTX Pro 6000 Blackwell, целевые 20 ТБ и 2,7 ТБ/с). На векторном поиске по индексу FAISS из 512 млн векторов десять MX1 дали 64× запросов в секунду против CPU с пулом CXL-памяти, а на Llama 3.1 70B (INT8, контекст 100 тыс. токенов) два сервера по пять MX1 подняли скорость генерации с 5,5 до 17,7 токена в секунду — в 3,35 раза.
Что это значит
Касается это тех, кто держит серверы для инференса и RAG — поиска по собственной базе документов перед ответом модели. Узкое место таких систем не вычисления, а память: HBM на видеокарте дорогая и её мало, а когда контекст и векторные индексы туда не влезают, данные гоняют через CPU. MX1 предлагает третий ярус между HBM и SSD, где дешёвая DDR5 и ядра рядом с ней берут на себя поиск, фильтрацию и подготовку данных.
Оговорки важнее рекордов. Все замеры сделала сама XCENA на своих нагрузках; независимых тестов нет, а кратные цифры вроде 64× получены против CPU, которому специально дали читать данные по медленному CXL. Плюс код под MX1 пишется отдельно, на C/C++ или Rust, а поддержку PyTorch и векторных баз компания только достраивает.
Горизонт для практика: полгода до серийных образцов и минимум год до того, как такие карты появятся у облачных провайдеров. Главный сигнал — подхватит ли идею Samsung как производитель памяти.
Контекст
XCENA основана выходцами из Samsung Electronics и SK hynix, штаб-квартира — в Южной Корее, офис — в Калифорнии. К августу 2026 года компания привлекла $185 млн, включая раунд B на $135 млн. Линейку MX1 она впервые показала в августе 2025 года; тогда речь шла о 1 ТБ на устройство.



