AMD Instinct MI350P: що вміє PCIe-прискорювач на 144 ГБ HBM3E і кому він справді потрібен
AMD Instinct MI350P — PCIe-прискорювач зі 144 ГБ HBM3E під ШІ. Розбираємо характеристики, чим відрізняється від MI350X і Nvidia H200 NVL, які LLM тягне і що з ціною.
Minisforum MS-03 на Panther Lake: міні-ПК під локальний ШІ — що він реально потягне
Розбір Minisforum MS-03 на Intel Panther Lake як бази для локального ШІ: специфікації, що потягне за tok/s, порівняння з Mac mini і Ryzen AI Max, правда про 90 TOPS.
Яку локальну LLM обрати у 2026: 11 моделей під задачу та залізо
Яку локальну LLM обрати у 2026: алгоритм від задачі та VRAM до моделі, майстер-таблиця 11 моделей із розборами та вибір під чат, код, зір і голос.
Claude поїхав на найновіших GB300 Blackwell Ultra: що це змінює для ШІ-хмари
Моделі Claude від Anthropic стали загальнодоступні в Microsoft Foundry на найновіших GPU NVIDIA GB300 Blackwell Ultra в Azure. Що це означає для корпоративного ШІ.
Supermicro показала Super AI Station на GB300: до 1 трлн параметрів локально, 748 ГБ пам’яті та 1600 Вт
Supermicro вивела Super AI Station на NVIDIA GB300: десктоп-суперкомп’ютер із 748 ГБ пам’яті, до 20 петафлопс і підтримкою моделей до 1 трлн параметрів. Ціна ~$125 000.
NVIDIA і AWS запустили G7-інстанси з Blackwell: 4,6x інференс, 10x векторний пошук
25 червня 2026 року NVIDIA і Amazon Web Services оголосили про нові інстанси Amazon EC2 G7 на базі GPU NVIDIA RTX PRO 4500 Blackwell Server Edition. Продуктивність AI-інференсу зросла у…
General Intuition: $320 млн за ідею навчати AI-агентів на відеоіграх
Стартап General Intuition закрив раунд на $320 млн при оцінці $2,3 млрд. Загальний обсяг залученого фінансування досяг $454 млн — включаючи сід-раунд на $134 млн у жовтні 2025 року. Ставка…
DDN готує сховище під Nvidia Rubin: KV-кеш прискорює інференс у 55 разів
DDN представила масив AI400X3M (до 190 ГБ/с читання) і прискорення KV-кешу з Nvidia Dynamo — до 55× швидше завантаження кешу для інференсу LLM під Vera Rubin.
