Qwen Coder на своєму ПК: локальна заміна GitHub Copilot
Огляд Qwen Coder для локального запуску у 2026: лінійка моделей, таблиця VRAM, автодоповнення FIM, інтеграція у VS Code, бенчмарки і чесне порівняння.
Збірка на AMD RX 7900 XTX для локального LLM: 24 ГБ за півціни RTX 4090 на ROCm
RX 7900 XTX — 24 ГБ за півціни RTX 4090: що тягне на ROCm (8B як у 3090, 32B, 70B), скільки коштує і кому AMD-шлях підходить, а кому стане пасткою.
Перероблений GMKtec EVO-X3 на Strix Halo: 128 ГБ спільної памʼяті під локальний ШІ — і цінник від $3600
GMKtec показала перероблений EVO-X3 на Ryzen AI Max+ 395: 128 ГБ LPDDR5X, NPU до 50 TOPS, старт 29 червня. Навіщо стільки памʼяті для локальних LLM.
GPT-OSS на своєму ПК: перші відкриті моделі OpenAI за роки
Коротко (TL;DR) GPT-OSS — це маленька сенсація: уперше з 2019 року (з часів GPT-2) OpenAI випустила відкриті моделі, які можна завантажити й запустити в себе. Реліз відбувся 5 серпня 2025…
Робоча станція на NVIDIA RTX PRO 6000 Blackwell: 96 ГБ на одній карті під 70B без мультикарти
RTX PRO 6000 Blackwell — 96 ГБ ECC на одній карті: вантажить Llama 70B у високій точності без мультикарти. Швидкість, ціна ($8500+) і кому вона потрібна.
Weibo випустила VibeThinker-3B — крихітну ризонінг-модель, що сперечається із системами в сотні разів більшими
WeiboAI виклала VibeThinker-3B під MIT у середині червня 2026: лише 3 млрд параметрів, та на матбенчмарках сперечається з моделями в сотні разів більшими.
Phi-4 на своєму ПК: 14B-модель Microsoft проти гігантів
Огляд Phi-4 для локального запуску у 2026: уся лінійка, таблиця VRAM, чому 14B б'є GPT-4o у STEM, чесно про контекст 16K, українську мову та ліцензію MIT.
Збірка на двох RTX 3090 для локального ШІ: 48 ГБ через NVLink дешевше, ніж одна RTX 5090
Дві б/в RTX 3090 дають 48 ГБ через NVLink — більше, ніж у RTX 5090, і втричі дешевше. Повний BOM, що тягне 70B, реальні ціни та граблі б/в-карт.
