local-llm

Робоча станція на RTX PRO 6000: 96 ГБ під 70B без мультикарти

RTX PRO 6000 Blackwell — 96 ГБ ECC на одній карті: вантажить Llama 70B у високій точності без мультикарти. Швидкість, ціна ($8500+) і кому вона потрібна.

17 хв. читання

Weibo випустила VibeThinker-3B — крихітну ризонінг-модель, що сперечається із системами в сотні разів більшими

WeiboAI виклала VibeThinker-3B під MIT у середині червня 2026: лише 3 млрд параметрів, та на матбенчмарках сперечається з моделями в сотні разів більшими.

2 хв. читання

Phi-4 на своєму ПК: 14B-модель Microsoft проти гігантів

Огляд Phi-4 для локального запуску у 2026: уся лінійка, таблиця VRAM, чому 14B б'є GPT-4o у STEM, чесно про контекст 16K, українську мову та ліцензію MIT.

19 хв. читання

Збірка на двох RTX 3090 для локального ШІ: 48 ГБ дешевше за одну RTX 5090

Дві б/в RTX 3090 дають 48 ГБ через NVLink — більше, ніж у RTX 5090, і втричі дешевше. Повний BOM, що тягне 70B, реальні ціни та граблі б/в-карт.

17 хв. читання

Lenovo випустила крихітний ARM-міні-ПК під локальний ШІ — без Intel та AMD, за $445

Lenovo AI Host Mini на китайському ARM-чипі Cixin P1 (45 TOPS), 8 ГБ ОЗП, ~373 г, ціною ~$445. Старт у Китаї 1 липня 2026 — компактний бокс під локальні ШІ-функції.

2 хв. читання

Microsoft відкрила FastContext — маленьку модель-«розвідника» репозиторію для агентів програмування

Microsoft виклала FastContext-1.0-4B-SFT під MIT: модель-субагент досліджує кодову базу й ріже витрати токенів основного агента до 60%. База — Qwen3-4B-Instruct.

2 хв. читання

Mistral Small на своєму ПК: європейська модель під одну відеокарту

Огляд Mistral Small для локального запуску у 2026: домашня 3.x проти серверної 4, таблиця VRAM, функції та агенти, ліцензія Apache 2.0, EU-приватність і українська.

19 хв. читання

Збірка ПК на RTX 5090 для локального ШІ: BOM і стеля 32 ГБ

RTX 5090 — король швидкості для моделей до 32B, але 32 ГБ — жорстка стеля. Повна збірка з цінами (~$4500), що влазить у VRAM і де виграє unified-memory.

16 хв. читання