local-llm

Weibo выпустила VibeThinker-3B — крошечную ризонинг-модель, спорящую с системами в сотни раз больше

WeiboAI выложила VibeThinker-3B под MIT в середине июня 2026: всего 3 млрд параметров, но на матбенчмарках спорит с моделями в сотни раз крупнее. Коротко о модели.

2 мин. чтения

Phi-4 на своём ПК: 14B-модель Microsoft против гигантов

Обзор Phi-4 для локального запуска в 2026: вся линейка, таблица VRAM, почему 14B бьёт GPT-4o в STEM, честно про контекст 16K, русский язык и лицензию MIT.

19 мин. чтения

Сборка на двух RTX 3090 для локального ИИ: 48 ГБ дешевле одной RTX 5090

Две б/у RTX 3090 дают 48 ГБ через NVLink — больше, чем у RTX 5090, и втрое дешевле. Полный BOM, что тянет 70B, реальные цены и грабли б/у-карт.

17 мин. чтения

Lenovo выпустила крошечный ARM-мини-ПК под локальный ИИ — без Intel и AMD, за $445

Lenovo AI Host Mini на китайском ARM-чипе Cixin P1 (45 TOPS), 8 ГБ ОЗУ, ~373 г, ценой ~$445. Старт в Китае 1 июля 2026 — компактный бокс под локальные ИИ-функции.

2 мин. чтения

Microsoft открыла FastContext — маленькую модель-«разведчика» репозитория для агентов программирования

Microsoft выложила FastContext-1.0-4B-SFT под MIT: модель-субагент исследует кодовую базу и режет расход токенов основного агента до 60%. База — Qwen3-4B-Instruct.

2 мин. чтения

Mistral Small на своём ПК: европейская модель под одну видеокарту

Обзор Mistral Small для локального запуска в 2026: домашняя 3.x против серверной 4, таблица VRAM, функции и агенты, лицензия Apache 2.0, EU-приватность и русский.

19 мин. чтения

Сборка ПК на RTX 5090 для локального ИИ: BOM и потолок 32 ГБ

RTX 5090 — король скорости для моделей до 32B, но 32 ГБ — жёсткий потолок. Полная сборка с ценами (~$4500), что влезает в VRAM и где выигрывает unified-memory.

16 мин. чтения

Два мини-ПК вместо облачных API: как локальный ИИ экономит на токенах

Журналист Tom's Hardware перевёл до двух третей ИИ-задач на пару мини-ПК с Ryzen AI Max+ 395, прокачивая до 80 млн токенов в день. Когда это реально оправдано.

2 мин. чтения