for-ai-llm

AMD Instinct MI350P: що вміє PCIe-прискорювач на 144 ГБ HBM3E і кому він справді потрібен

AMD Instinct MI350P — PCIe-прискорювач зі 144 ГБ HBM3E під ШІ. Розбираємо характеристики, чим відрізняється від MI350X і Nvidia H200 NVL, які LLM тягне і що з ціною.

17 хв. читання

Minisforum MS-03 на Panther Lake: міні-ПК під локальний ШІ — що він реально потягне

Розбір Minisforum MS-03 на Intel Panther Lake як бази для локального ШІ: специфікації, що потягне за tok/s, порівняння з Mac mini і Ryzen AI Max, правда про 90 TOPS.

14 хв. читання

Яку локальну LLM обрати у 2026: 11 моделей під задачу та залізо

Яку локальну LLM обрати у 2026: алгоритм від задачі та VRAM до моделі, майстер-таблиця 11 моделей із розборами та вибір під чат, код, зір і голос.

14 хв. читання

Claude поїхав на найновіших GB300 Blackwell Ultra: що це змінює для ШІ-хмари

Моделі Claude від Anthropic стали загальнодоступні в Microsoft Foundry на найновіших GPU NVIDIA GB300 Blackwell Ultra в Azure. Що це означає для корпоративного ШІ.

2 хв. читання

Supermicro показала Super AI Station на GB300: до 1 трлн параметрів локально, 748 ГБ пам’яті та 1600 Вт

Supermicro вивела Super AI Station на NVIDIA GB300: десктоп-суперкомп’ютер із 748 ГБ пам’яті, до 20 петафлопс і підтримкою моделей до 1 трлн параметрів. Ціна ~$125 000.

2 хв. читання

NVIDIA і AWS запустили G7-інстанси з Blackwell: 4,6x інференс, 10x векторний пошук

25 червня 2026 року NVIDIA і Amazon Web Services оголосили про нові інстанси Amazon EC2 G7 на базі GPU NVIDIA RTX PRO 4500 Blackwell Server Edition. Продуктивність AI-інференсу зросла у…

2 хв. читання

General Intuition: $320 млн за ідею навчати AI-агентів на відеоіграх

Стартап General Intuition закрив раунд на $320 млн при оцінці $2,3 млрд. Загальний обсяг залученого фінансування досяг $454 млн — включаючи сід-раунд на $134 млн у жовтні 2025 року. Ставка…

2 хв. читання

DDN готує сховище під Nvidia Rubin: KV-кеш прискорює інференс у 55 разів

DDN представила масив AI400X3M (до 190 ГБ/с читання) і прискорення KV-кешу з Nvidia Dynamo — до 55× швидше завантаження кешу для інференсу LLM під Vera Rubin.

2 хв. читання