llama-cpp

DeepSeek-R1 на своём ПК: рассуждающая модель через дистилляты

Как запустить DeepSeek-R1 локально в 2026: почему 671B не для дома, какой дистиллят выбрать под VRAM, таблица скорости, лицензия MIT и честно про цензуру.

21 мин. чтения

Llama на своём компьютере: разбор версий, железа и лицензии в 2026

Какую Llama запустить дома: разбор версий и требований к VRAM, ловушка MoE в Scout, границы лицензии Meta и запуск через Ollama, LM Studio или llama.cpp.

27 мин. чтения

Unsloth выложила diffusiongemma-26B-GGUF — 80 000 загрузок за 4 дня, диффузионный LLM на Gemma

Unsloth выложила GGUF diffusiongemma-26B ~10 июня 2026: диффузионный LLM на Gemma для llama.cpp. За 4 дня — 80 000+ загрузок. Разбираем архитектуру и применение.

2 мин. чтения

Moonshot AI выпустила Kimi K2.7 Code — триллион параметров и -30% токенов мышления

11 июня 2026 вышла Kimi K2.7 Code от Moonshot AI: MoE 1T/32B активных, контекст 256K. На MCPMark-Verified — 81.1%, быстрее K2.6 на 30% по токенам рассуждения.

2 мин. чтения