Nutanix замінила Copilot і Claude кластером за $20 млн: окупність — рік
Голова Nutanix розповів 27 серпня 2026 року: розробники перейшли з Copilot і Claude на open-weight моделі у власному кластері за $20 млн. Рахуємо, коли це вигідно.
XCENA MX1 на Hot Chips 2026: 2 ТБ DDR5 через CXL і 3072 ядра RISC-V біля пам’яті
26 серпня 2026 року XCENA показала на Hot Chips архітектуру MX1: до 2 ТБ DDR5 через CXL 3.2, SSD у ролі пам'яті та 3072 ядра RISC-V, що обчислюють поруч із…
Відеопам’ять під LLM: 10 моделей, 5 квантів і формула для KV-кешу
Скільки відеопам'яті потрібно під модель: таблиця по 10 моделях і 5 квантах, реальні розміри GGUF, розрахунок KV-кешу за контекстом і що робити, коли не влазить.
Один чип замість трьох плат: AMD принесла Strix Halo в робототехніку під назвою Ryzen AI Embedded X100
AMD представила вбудовувані процесори Ryzen AI Embedded X100: до 16 ядер Zen 5, 40 блоків RDNA 3.5 і NPU на 50 TOPS в одному корпусі з тепловим пакетом 45 Вт.
ROCm проти CUDA: де Radeon наздогнав GeForce, а де втратите час
Розбираємо ROCm vs CUDA за завданнями: інференс, донавчання, дифузія. Які Radeon підтримані, де Vulkan обганяє ROCm і скільки коштує гігабайт відеопамʼяті.
AMD Instinct MI350P: PCIe-прискорювач на 144 ГБ HBM3E і кому він потрібен
AMD Instinct MI350P — PCIe-прискорювач зі 144 ГБ HBM3E під ШІ. Розбираємо характеристики, чим відрізняється від MI350X і Nvidia H200 NVL, які LLM тягне і що з ціною.
Minisforum MS-03 на Panther Lake: міні-ПК під локальний ШІ — що він реально потягне
Розбір Minisforum MS-03 на Intel Panther Lake як бази для локального ШІ: специфікації, що потягне за tok/s, порівняння з Mac mini і Ryzen AI Max, правда про 90 TOPS.
Яку локальну LLM обрати в 2026: 11 моделей під задачу та залізо
Яку локальну LLM обрати у 2026: алгоритм від задачі та VRAM до моделі, майстер-таблиця 11 моделей із розборами та вибір під чат, код, зір і голос.
