for-ai-llm

Claude поехал на новейших GB300 Blackwell Ultra: что это меняет для ИИ-облака

Модели Claude от Anthropic стали общедоступны в Microsoft Foundry на новейших GPU NVIDIA GB300 Blackwell Ultra в Azure. Что это значит для корпоративного ИИ.

2 мин. чтения

Supermicro показала Super AI Station на GB300: до 1 трлн параметров локально, 748 ГБ памяти и 1600 Вт

Supermicro вывела Super AI Station на NVIDIA GB300: десктоп-суперкомпьютер с 748 ГБ памяти, до 20 петафлопс и поддержкой моделей до 1 трлн параметров. Цена ~$125 000.

2 мин. чтения

NVIDIA и AWS запустили G7-инстансы с Blackwell: 4,6x инференс, 10x векторный поиск

NVIDIA и AWS запустили инстансы EC2 G7 на Blackwell: AI-инференс в 4,6 раза быстрее G6, а векторный поиск в OpenSearch ускорили с помощью cuVS.

2 мин. чтения

General Intuition: $320 млн за идею обучать AI-агентов на видеоиграх

General Intuition привлекла $320 млн при оценке $2,3 млрд: компания учит AI-агентов на сотнях миллионов часов геймплея. Среди инвесторов — Безос.

2 мин. чтения

DDN готовит хранилище под Nvidia Rubin: KV-кэш ускоряет инференс в 55 раз

DDN представила массив AI400X3M (до 190 ГБ/с чтения) и ускорение KV-кэша с Nvidia Dynamo — до 55× быстрее загрузки кэша для инференса LLM под платформу Vera Rubin.

2 мин. чтения

Какой компьютер нужен для локального ИИ: простой разбор по задачам и бюджету

Какой компьютер собрать для локального ИИ под кодинг, чат, документы или картинки: словарь терминов, сборки по бюджету в гривнах и долларах, реальные цены.

29 мин. чтения

Как выбрать железо для локального ИИ: гид по GPU, Mac и мини-ПК

Как выбрать железо для локального ИИ в 2026: алгоритм от модели к железу, мастер-таблица решений и что взять по бюджету и задаче — ёмкость против скорости.

16 мин. чтения

Framework Desktop для локального ИИ: Strix Halo на 128 ГБ и цифры

Framework Desktop — модульный DIY-десктоп на Strix Halo (128 ГБ): материнка отдельно, кластер до 671B, но память распаяна. Реальная скорость MoE против плотных.

16 мин. чтения