AMD Instinct MI350P: что умеет PCIe-ускоритель на 144 ГБ HBM3E и кому он реально нужен
AMD Instinct MI350P — PCIe-ускоритель со 144 ГБ HBM3E под ИИ. Разбираем характеристики, чем отличается от MI350X и Nvidia H200 NVL, какие LLM тянет и что с ценой.
Minisforum MS-03 на Panther Lake: мини-ПК под локальный ИИ — что он реально потянет
Разбор Minisforum MS-03 на Intel Panther Lake как базы для локального ИИ: спеки, что потянет по tok/s, сравнение с Mac mini и Ryzen AI Max, правда про 90 TOPS.
Какую локальную LLM выбрать в 2026: 11 моделей под задачу и железо
Какую локальную LLM выбрать в 2026: алгоритм от задачи и VRAM к модели, мастер-таблица 11 моделей с ссылками на разборы и выбор под чат, код, зрение и голос.
Claude поехал на новейших GB300 Blackwell Ultra: что это меняет для ИИ-облака
Модели Claude от Anthropic стали общедоступны в Microsoft Foundry на новейших GPU NVIDIA GB300 Blackwell Ultra в Azure. Что это значит для корпоративного ИИ.
Supermicro показала Super AI Station на GB300: до 1 трлн параметров локально, 748 ГБ памяти и 1600 Вт
Supermicro вывела Super AI Station на NVIDIA GB300: десктоп-суперкомпьютер с 748 ГБ памяти, до 20 петафлопс и поддержкой моделей до 1 трлн параметров. Цена ~$125 000.
NVIDIA и AWS запустили G7-инстансы с Blackwell: 4,6x инференс, 10x векторный поиск
25 июня 2026 года NVIDIA и Amazon Web Services объявили о новых инстансах Amazon EC2 G7, основанных на GPU NVIDIA RTX PRO 4500 Blackwell Server Edition. Производительность в AI-инференсе выросла…
General Intuition: $320 млн за идею обучать AI-агентов на видеоиграх
Стартап General Intuition закрыл раунд на $320 млн при оценке $2,3 млрд. Общий объём привлечённого финансирования достиг $454 млн — включая сид-раунд на $134 млн в октябре 2025 года. Ставка…
DDN готовит хранилище под Nvidia Rubin: KV-кэш ускоряет инференс в 55 раз
DDN представила массив AI400X3M (до 190 ГБ/с чтения) и ускорение KV-кэша с Nvidia Dynamo — до 55× быстрее загрузки кэша для инференса LLM под платформу Vera Rubin.
