llama-cpp

DeepSeek-R1 на своєму ПК: модель, що міркує, через дистиляти

Як запустити DeepSeek-R1 локально у 2026: чому 671B не для дому, який дистилят обрати під VRAM, таблиця швидкості, ліцензія MIT і чесно про цензуру.

21 хв. читання

Llama на власному комп’ютері: розбір версій, заліза та ліцензії у 2026

Яку Llama запустити вдома: розбір версій і вимог до VRAM, пастка MoE у Scout, межі ліцензії Meta та запуск через Ollama, LM Studio або llama.cpp.

27 хв. читання

Unsloth виклала diffusiongemma-26B-GGUF — 80 000 завантажень за 4 дні, дифузійний LLM на Gemma

Unsloth виклала GGUF diffusiongemma-26B ~10 червня 2026: дифузійний LLM на Gemma для llama.cpp. За 4 дні — 80 000+ завантажень. Розбираємо архітектуру і застосування.

2 хв. читання

Moonshot AI випустила Kimi K2.7 Code — трильйон параметрів і -30% токенів мислення

11 червня 2026 вийшла Kimi K2.7 Code від Moonshot AI: MoE 1T/32B активних, контекст 256K. MCPMark-Verified — 81.1%, менше thinking-токенів на 30% порівняно з K2.6.

2 хв. читання