for-ai-llm

AMD Instinct MI350P: что умеет PCIe-ускоритель на 144 ГБ HBM3E и кому он реально нужен

AMD Instinct MI350P — PCIe-ускоритель со 144 ГБ HBM3E под ИИ. Разбираем характеристики, чем отличается от MI350X и Nvidia H200 NVL, какие LLM тянет и что с ценой.

17 мин. чтения

Minisforum MS-03 на Panther Lake: мини-ПК под локальный ИИ — что он реально потянет

Разбор Minisforum MS-03 на Intel Panther Lake как базы для локального ИИ: спеки, что потянет по tok/s, сравнение с Mac mini и Ryzen AI Max, правда про 90 TOPS.

14 мин. чтения

Какую локальную LLM выбрать в 2026: 11 моделей под задачу и железо

Какую локальную LLM выбрать в 2026: алгоритм от задачи и VRAM к модели, мастер-таблица 11 моделей с ссылками на разборы и выбор под чат, код, зрение и голос.

14 мин. чтения

Claude поехал на новейших GB300 Blackwell Ultra: что это меняет для ИИ-облака

Модели Claude от Anthropic стали общедоступны в Microsoft Foundry на новейших GPU NVIDIA GB300 Blackwell Ultra в Azure. Что это значит для корпоративного ИИ.

2 мин. чтения

Supermicro показала Super AI Station на GB300: до 1 трлн параметров локально, 748 ГБ памяти и 1600 Вт

Supermicro вывела Super AI Station на NVIDIA GB300: десктоп-суперкомпьютер с 748 ГБ памяти, до 20 петафлопс и поддержкой моделей до 1 трлн параметров. Цена ~$125 000.

2 мин. чтения

NVIDIA и AWS запустили G7-инстансы с Blackwell: 4,6x инференс, 10x векторный поиск

25 июня 2026 года NVIDIA и Amazon Web Services объявили о новых инстансах Amazon EC2 G7, основанных на GPU NVIDIA RTX PRO 4500 Blackwell Server Edition. Производительность в AI-инференсе выросла…

2 мин. чтения

General Intuition: $320 млн за идею обучать AI-агентов на видеоиграх

Стартап General Intuition закрыл раунд на $320 млн при оценке $2,3 млрд. Общий объём привлечённого финансирования достиг $454 млн — включая сид-раунд на $134 млн в октябре 2025 года. Ставка…

2 мин. чтения

DDN готовит хранилище под Nvidia Rubin: KV-кэш ускоряет инференс в 55 раз

DDN представила массив AI400X3M (до 190 ГБ/с чтения) и ускорение KV-кэша с Nvidia Dynamo — до 55× быстрее загрузки кэша для инференса LLM под платформу Vera Rubin.

2 мин. чтения