Робоча станція на RTX PRO 6000: 96 ГБ під 70B без мультикарти
RTX PRO 6000 Blackwell — 96 ГБ ECC на одній карті: вантажить Llama 70B у високій точності без мультикарти. Швидкість, ціна ($8500+) і кому вона потрібна.
Weibo випустила VibeThinker-3B — крихітну ризонінг-модель, що сперечається із системами в сотні разів більшими
WeiboAI виклала VibeThinker-3B під MIT у середині червня 2026: лише 3 млрд параметрів, та на матбенчмарках сперечається з моделями в сотні разів більшими.
Phi-4 на своєму ПК: 14B-модель Microsoft проти гігантів
Огляд Phi-4 для локального запуску у 2026: уся лінійка, таблиця VRAM, чому 14B б'є GPT-4o у STEM, чесно про контекст 16K, українську мову та ліцензію MIT.
Збірка на двох RTX 3090 для локального ШІ: 48 ГБ дешевше за одну RTX 5090
Дві б/в RTX 3090 дають 48 ГБ через NVLink — більше, ніж у RTX 5090, і втричі дешевше. Повний BOM, що тягне 70B, реальні ціни та граблі б/в-карт.
Lenovo випустила крихітний ARM-міні-ПК під локальний ШІ — без Intel та AMD, за $445
Lenovo AI Host Mini на китайському ARM-чипі Cixin P1 (45 TOPS), 8 ГБ ОЗП, ~373 г, ціною ~$445. Старт у Китаї 1 липня 2026 — компактний бокс під локальні ШІ-функції.
Microsoft відкрила FastContext — маленьку модель-«розвідника» репозиторію для агентів програмування
Microsoft виклала FastContext-1.0-4B-SFT під MIT: модель-субагент досліджує кодову базу й ріже витрати токенів основного агента до 60%. База — Qwen3-4B-Instruct.
Mistral Small на своєму ПК: європейська модель під одну відеокарту
Огляд Mistral Small для локального запуску у 2026: домашня 3.x проти серверної 4, таблиця VRAM, функції та агенти, ліцензія Apache 2.0, EU-приватність і українська.
Збірка ПК на RTX 5090 для локального ШІ: BOM і стеля 32 ГБ
RTX 5090 — король швидкості для моделей до 32B, але 32 ГБ — жорстка стеля. Повна збірка з цінами (~$4500), що влазить у VRAM і де виграє unified-memory.
