Nutanix заменила Copilot и Claude кластером за $20 млн: окупаемость — год
Глава Nutanix рассказал 27 августа 2026 года: разработчики перешли с Copilot и Claude на open-weight модели в своём кластере за $20 млн. Считаем, когда это выгодно.
XCENA MX1 на Hot Chips 2026: до 2 ТБ DDR5 по CXL и 3072 ядра RISC-V рядом с памятью
26 августа 2026 года XCENA показала на Hot Chips архитектуру MX1: до 2 ТБ DDR5 по CXL 3.2, SSD в роли памяти и 3072 ядра RISC-V, которые считают рядом с…
Видеопамять под LLM: 10 моделей, 5 квантов и формула для KV-кэша
Сколько видеопамяти нужно под модель: таблица по 10 моделям и 5 квантам, реальные размеры GGUF, расчёт KV-кэша по длине контекста и что делать, когда не влезает.
Один чип вместо трёх плат: AMD принесла Strix Halo в робототехнику под именем Ryzen AI Embedded X100
AMD представила встраиваемые процессоры Ryzen AI Embedded X100: до 16 ядер Zen 5, 40 блоков RDNA 3.5 и NPU на 50 TOPS в одном корпусе с теплопакетом 45 Вт.
ROCm против CUDA: где Radeon догнал GeForce, а где потеряете время
Разбираем ROCm vs CUDA по задачам: инференс, дообучение, диффузия. Какие Radeon поддержаны, где Vulkan обгоняет ROCm и сколько стоит гигабайт VRAM.
AMD Instinct MI350P: PCIe-ускоритель на 144 ГБ HBM3E и кому он нужен
AMD Instinct MI350P — PCIe-ускоритель со 144 ГБ HBM3E под ИИ. Разбираем характеристики, чем отличается от MI350X и Nvidia H200 NVL, какие LLM тянет и что с ценой.
Minisforum MS-03 на Panther Lake: мини-ПК под локальный ИИ — что он реально потянет
Разбор Minisforum MS-03 на Intel Panther Lake как базы для локального ИИ: спеки, что потянет по tok/s, сравнение с Mac mini и Ryzen AI Max, правда про 90 TOPS.
Какую локальную LLM выбрать в 2026: 11 моделей под задачу и железо
Какую локальную LLM выбрать в 2026: алгоритм от задачи и VRAM к модели, мастер-таблица 11 моделей с ссылками на разборы и выбор под чат, код, зрение и голос.
