quantization

Phi-4 на своём ПК: 14B-модель Microsoft против гигантов

Обзор Phi-4 для локального запуска в 2026: вся линейка, таблица VRAM, почему 14B бьёт GPT-4o в STEM, честно про контекст 16K, русский язык и лицензию MIT.

19 мин. чтения

Mistral Small на своём ПК: европейская модель под одну видеокарту

Обзор Mistral Small для локального запуска в 2026: домашняя 3.x против серверной 4, таблица VRAM, функции и агенты, лицензия Apache 2.0, EU-приватность и русский.

19 мин. чтения

Gemma 3 и Gemma 4 на своём ПК: лучшая модель под одну видеокарту

Обзор Gemma для локального запуска в 2026: линейки 3 и 4, таблица VRAM по квантам, QAT-кванты Google, мультимодальность, лицензия Apache 2.0 и русский язык.

17 мин. чтения

DeepSeek-R1 на своём ПК: рассуждающая модель через дистилляты

Как запустить DeepSeek-R1 локально в 2026: почему 671B не для дома, какой дистиллят выбрать под VRAM, таблица скорости, лицензия MIT и честно про цензуру.

21 мин. чтения

Qwen3 на своём ПК: почему это «модель по умолчанию» для локального ИИ

Обзор Qwen3 для локального запуска в 2026: линейка моделей, таблица VRAM и скорости по квантам, гибридный режим рассуждений, русский язык, честно про цензуру.

22 мин. чтения

Wispr Flow или свой Whisper: облачная и офлайн-диктовка

Разбираем Wispr Flow и локальную диктовку на Whisper: тарифы, почему Privacy Mode не офлайн, требования к железу и пошаговая установка офлайн-диктовки.

24 мин. чтения

Llama на своём компьютере: разбор версий, железа и лицензии в 2026

Какую Llama запустить дома: разбор версий и требований к VRAM, ловушка MoE в Scout, границы лицензии Meta и запуск через Ollama, LM Studio или llama.cpp.

27 мин. чтения

Vision-модели локально: от LLaVA до Qwen2.5-VL на своём ПК

Обзор локальных vision-моделей в 2026: какую выбрать под железо для OCR и описания картинок, таблица VRAM, ловушка disk≠VRAM, запуск и реальные ограничения.

23 мин. чтения