Видеопамять под LLM: 10 моделей, 5 квантов и формула для KV-кэша
Сколько видеопамяти нужно под модель: таблица по 10 моделям и 5 квантам, реальные размеры GGUF, расчёт KV-кэша по длине контекста и что делать, когда не влезает.
Qwen Coder на своём ПК: локальная замена GitHub Copilot
Обзор Qwen Coder для локального запуска в 2026: линейка моделей, таблица VRAM, автодополнение FIM, интеграция в VS Code, бенчмарки и честное сравнение.
Mistral Small на своём ПК: европейская модель под одну видеокарту
Обзор Mistral Small для локального запуска в 2026: домашняя 3.x против серверной 4, таблица VRAM, функции и агенты, лицензия Apache 2.0, EU-приватность и русский.
Gemma 3 и Gemma 4 на своём ПК: лучшая модель под одну видеокарту
Обзор Gemma для локального запуска в 2026: линейки 3 и 4, таблица VRAM по квантам, QAT-кванты Google, мультимодальность, лицензия Apache 2.0 и русский язык.
DeepSeek-R1 на своём ПК: рассуждающая модель через дистилляты
Как запустить DeepSeek-R1 локально в 2026: почему 671B не для дома, какой дистиллят выбрать под VRAM, таблица скорости, лицензия MIT и честно про цензуру.
Qwen3 на своём ПК: почему это «модель по умолчанию» для локального ИИ
Обзор Qwen3 для локального запуска в 2026: линейка моделей, таблица VRAM и скорости по квантам, гибридный режим рассуждений, русский язык, честно про цензуру.
Llama на своём компьютере: разбор версий, железа и лицензии в 2026
Какую Llama запустить дома: разбор версий и требований к VRAM, ловушка MoE в Scout, границы лицензии Meta и запуск через Ollama, LM Studio или llama.cpp.
Vision-модели локально: от LLaVA до Qwen2.5-VL на своём ПК
Обзор локальных vision-моделей в 2026: какую выбрать под железо для OCR и описания картинок, таблица VRAM, ловушка disk≠VRAM, запуск и реальные ограничения.