quantization

GLM від Z.ai на своєму ПК: чи реально запустити фронтир-модель удома

Огляд GLM (Z.ai) для локального запуску у 2026: лінійка 4.6 і Flash, таблиця VRAM, агентний кодинг, MoE-offloading, ліцензія MIT, вимоги до заліза та українська.

26 хв. читання

Qwen Coder на своєму ПК: локальна заміна GitHub Copilot

Огляд Qwen Coder для локального запуску у 2026: лінійка моделей, таблиця VRAM, автодоповнення FIM, інтеграція у VS Code, бенчмарки і чесне порівняння.

19 хв. читання

GPT-OSS на своєму ПК: перші відкриті моделі OpenAI за роки

Відкриті моделі OpenAI на власному ПК: скільки треба VRAM для 20B і 120B, які кванти обрати, як налаштувати глибину міркування і не спіткнутись об Harmony.

21 хв. читання

Phi-4 на своєму ПК: 14B-модель Microsoft проти гігантів

Огляд Phi-4 для локального запуску у 2026: уся лінійка, таблиця VRAM, чому 14B б'є GPT-4o у STEM, чесно про контекст 16K, українську мову та ліцензію MIT.

19 хв. читання

Mistral Small на своєму ПК: європейська модель під одну відеокарту

Огляд Mistral Small для локального запуску у 2026: домашня 3.x проти серверної 4, таблиця VRAM, функції та агенти, ліцензія Apache 2.0, EU-приватність і українська.

19 хв. читання

Gemma 3 і Gemma 4 на своєму ПК: найкраща модель під одну відеокарту

Огляд Gemma для локального запуску у 2026: лінійки 3 і 4, таблиця VRAM за квантами, QAT-кванти Google, мультимодальність, ліцензія Apache 2.0 та українська мова.

17 хв. читання

DeepSeek-R1 на своєму ПК: модель, що міркує, через дистиляти

Як запустити DeepSeek-R1 локально у 2026: чому 671B не для дому, який дистилят обрати під VRAM, таблиця швидкості, ліцензія MIT і чесно про цензуру.

21 хв. читання

Qwen3 на своєму ПК: чому це «модель за замовчуванням» для локального ШІ

Огляд Qwen3 для локального запуску у 2026: лінійка моделей, таблиця VRAM і швидкості за квантами, гібридний режим міркувань, українська мова, чесно про цензуру.

22 хв. читання