Відеопам’ять під LLM: 10 моделей, 5 квантів і формула для KV-кешу
Скільки відеопам'яті потрібно під модель: таблиця по 10 моделях і 5 квантах, реальні розміри GGUF, розрахунок KV-кешу за контекстом і що робити, коли не влазить.
Qwen Coder на своєму ПК: локальна заміна GitHub Copilot
Огляд Qwen Coder для локального запуску у 2026: лінійка моделей, таблиця VRAM, автодоповнення FIM, інтеграція у VS Code, бенчмарки і чесне порівняння.
Mistral Small на своєму ПК: європейська модель під одну відеокарту
Огляд Mistral Small для локального запуску у 2026: домашня 3.x проти серверної 4, таблиця VRAM, функції та агенти, ліцензія Apache 2.0, EU-приватність і українська.
Gemma 3 і Gemma 4 на своєму ПК: найкраща модель під одну відеокарту
Огляд Gemma для локального запуску у 2026: лінійки 3 і 4, таблиця VRAM за квантами, QAT-кванти Google, мультимодальність, ліцензія Apache 2.0 та українська мова.
DeepSeek-R1 на своєму ПК: модель, що міркує, через дистиляти
Як запустити DeepSeek-R1 локально у 2026: чому 671B не для дому, який дистилят обрати під VRAM, таблиця швидкості, ліцензія MIT і чесно про цензуру.
Qwen3 на своєму ПК: чому це «модель за замовчуванням» для локального ШІ
Огляд Qwen3 для локального запуску у 2026: лінійка моделей, таблиця VRAM і швидкості за квантами, гібридний режим міркувань, українська мова, чесно про цензуру.
Llama на власному комп’ютері: розбір версій, заліза та ліцензії у 2026
Яку Llama запустити вдома: розбір версій і вимог до VRAM, пастка MoE у Scout, межі ліцензії Meta та запуск через Ollama, LM Studio або llama.cpp.
Vision-моделі локально: від LLaVA до Qwen2.5-VL на ПК
Огляд локальних vision-моделей у 2026: яку обрати під залізо для OCR і опису картинок, таблиця VRAM, пастка disk≠VRAM, запуск і реальні обмеження.