DeepSeek-R1 на своём ПК: рассуждающая модель через дистилляты
Как запустить DeepSeek-R1 локально в 2026: почему 671B не для дома, какой дистиллят выбрать под VRAM, таблица скорости, лицензия MIT и честно про цензуру.
Qwen3 на своём ПК: почему это «модель по умолчанию» для локального ИИ
Обзор Qwen3 для локального запуска в 2026: линейка моделей, таблица VRAM и скорости по квантам, гибридный режим рассуждений, русский язык, честно про цензуру.
Mac Studio M3 Ultra для нейросетей: король памяти, который тянет 671B локально — и где он спотыкается
Mac Studio M3 Ultra — 512 ГБ и 819 ГБ/с: единственный десктоп, что держит 671B локально. Разбираем реальные tok/s, цену и где он уступает видеокарте и DGX Spark.
Wispr Flow или свой Whisper: облачная и офлайн-диктовка
Разбираем Wispr Flow и локальную диктовку на Whisper: тарифы, почему Privacy Mode не офлайн, требования к железу и пошаговая установка офлайн-диктовки.
Llama на своём компьютере: разбор версий, железа и лицензии в 2026
Коротко (TL;DR) Llama от Meta — самое популярное семейство open-weight моделей в мире и одно из самых скачиваемых в каталоге Ollama. Для локального запуска это значит огромную экосистему, готовые сборки…
NVIDIA DGX Spark для нейросетей: какие модели запустишь локально и стоит ли он своих денег
DGX Spark — 128 ГБ единой памяти и стек NVIDIA на столе. Разбираем реальные tok/s, цену $4699 и честное сравнение со Strix Halo, Mac Studio и сборкой на RTX 3090.
Vision-модели локально: от LLaVA до Qwen2.5-VL на своём ПК
Обзор локальных vision-моделей в 2026: какую выбрать под железо для OCR и описания картинок, таблица VRAM, ловушка disk≠VRAM, запуск и реальные ограничения.
Ryzen AI Max+ 395 для нейросетей: какие модели реально запустишь локально и с какой скоростью
Strix Halo и 128 ГБ единой памяти грузят 70B-модели, которые не лезут в обычный GPU. Реальные tok/s, настройка, цены и стоит ли ждать 192-ГБ Gorgon Halo.
