local-llm

Два мини-ПК вместо облачных API: как локальный ИИ экономит на токенах

Журналист Tom's Hardware перевёл до двух третей ИИ-задач на пару мини-ПК с Ryzen AI Max+ 395, прокачивая до 80 млн токенов в день. Когда это реально оправдано.

2 мин. чтения

Gemma 3 и Gemma 4 на своём ПК: лучшая модель под одну видеокарту

Обзор Gemma для локального запуска в 2026: линейки 3 и 4, таблица VRAM по квантам, QAT-кванты Google, мультимодальность, лицензия Apache 2.0 и русский язык.

17 мин. чтения

Mac Mini M4 Pro для нейросетей: самый дешёвый вход в локальный ИИ

Mac Mini M4 Pro — самый дешёвый вход в локальные LLM на единой памяти. Что влезает по RAM, реальные tok/s, цена и где он уступает Strix Halo и Mac Studio.

15 мин. чтения

Z.ai выпустила GLM-5.2 с открытыми весами: 753B параметров, контекст 1M и лицензия MIT

Z.ai (бывшая Zhipu) выпустила GLM-5.2 — открытую MoE-модель на 753 млрд параметров с контекстом 1M и лицензией MIT. Заявлено, что обходит GPT-5.5 в коде.

2 мин. чтения

DeepSeek-R1 на своём ПК: рассуждающая модель через дистилляты

Как запустить DeepSeek-R1 локально в 2026: почему 671B не для дома, какой дистиллят выбрать под VRAM, таблица скорости, лицензия MIT и честно про цензуру.

21 мин. чтения

Qwen3 на своём ПК: почему это «модель по умолчанию» для локального ИИ

Обзор Qwen3 для локального запуска в 2026: линейка моделей, таблица VRAM и скорости по квантам, гибридный режим рассуждений, русский язык, честно про цензуру.

22 мин. чтения

Mac Studio M3 Ultra для нейросетей: тянет 671B локально — и где спотыкается

Mac Studio M3 Ultra — 512 ГБ и 819 ГБ/с: единственный десктоп, что держит 671B локально. Разбираем реальные tok/s, цену и где он уступает видеокарте и DGX Spark.

16 мин. чтения

Wispr Flow или свой Whisper: облачная и офлайн-диктовка

Разбираем Wispr Flow и локальную диктовку на Whisper: тарифы, почему Privacy Mode не офлайн, требования к железу и пошаговая установка офлайн-диктовки.

24 мин. чтения