Два мини-ПК вместо облачных API: как локальный ИИ экономит на токенах
Журналист Tom's Hardware перевёл до двух третей ИИ-задач на пару мини-ПК с Ryzen AI Max+ 395, прокачивая до 80 млн токенов в день. Когда это реально оправдано.
Gemma 3 и Gemma 4 на своём ПК: лучшая модель под одну видеокарту
Обзор Gemma для локального запуска в 2026: линейки 3 и 4, таблица VRAM по квантам, QAT-кванты Google, мультимодальность, лицензия Apache 2.0 и русский язык.
Mac Mini M4 Pro для нейросетей: самый дешёвый вход в локальный ИИ
Mac Mini M4 Pro — самый дешёвый вход в локальные LLM на единой памяти. Что влезает по RAM, реальные tok/s, цена и где он уступает Strix Halo и Mac Studio.
Z.ai выпустила GLM-5.2 с открытыми весами: 753B параметров, контекст 1M и лицензия MIT
Z.ai (бывшая Zhipu) выпустила GLM-5.2 — открытую MoE-модель на 753 млрд параметров с контекстом 1M и лицензией MIT. Заявлено, что обходит GPT-5.5 в коде.
DeepSeek-R1 на своём ПК: рассуждающая модель через дистилляты
Как запустить DeepSeek-R1 локально в 2026: почему 671B не для дома, какой дистиллят выбрать под VRAM, таблица скорости, лицензия MIT и честно про цензуру.
Qwen3 на своём ПК: почему это «модель по умолчанию» для локального ИИ
Обзор Qwen3 для локального запуска в 2026: линейка моделей, таблица VRAM и скорости по квантам, гибридный режим рассуждений, русский язык, честно про цензуру.
Mac Studio M3 Ultra для нейросетей: тянет 671B локально — и где спотыкается
Mac Studio M3 Ultra — 512 ГБ и 819 ГБ/с: единственный десктоп, что держит 671B локально. Разбираем реальные tok/s, цену и где он уступает видеокарте и DGX Spark.
Wispr Flow или свой Whisper: облачная и офлайн-диктовка
Разбираем Wispr Flow и локальную диктовку на Whisper: тарифы, почему Privacy Mode не офлайн, требования к железу и пошаговая установка офлайн-диктовки.
