llama-cpp

Ollama подняла Series B на $65 млн — почему это важно для локального ИИ

Раннер моделей с открытыми весами Ollama закрыл Series B на $65 млн (Theory Ventures) и вырос до 8,9 млн разработчиков. Что это значит для локального ИИ.

2 мин. чтения

GPT-OSS на своём ПК: первые открытые модели OpenAI за годы

Открытые модели OpenAI на своём ПК: сколько нужно VRAM для 20B и 120B, какие кванты выбрать, как настроить глубину рассуждений и не споткнуться о Harmony.

21 мин. чтения

Phi-4 на своём ПК: 14B-модель Microsoft против гигантов

Обзор Phi-4 для локального запуска в 2026: вся линейка, таблица VRAM, почему 14B бьёт GPT-4o в STEM, честно про контекст 16K, русский язык и лицензию MIT.

19 мин. чтения

DeepSeek-R1 на своём ПК: рассуждающая модель через дистилляты

Как запустить DeepSeek-R1 локально в 2026: почему 671B не для дома, какой дистиллят выбрать под VRAM, таблица скорости, лицензия MIT и честно про цензуру.

21 мин. чтения

Llama на своём компьютере: разбор версий, железа и лицензии в 2026

Какую Llama запустить дома: разбор версий и требований к VRAM, ловушка MoE в Scout, границы лицензии Meta и запуск через Ollama, LM Studio или llama.cpp.

27 мин. чтения

Unsloth выложила diffusiongemma-26B-GGUF — 80 000 загрузок за 4 дня, диффузионный LLM на Gemma

Unsloth выложила GGUF diffusiongemma-26B ~10 июня 2026: диффузионный LLM на Gemma для llama.cpp. За 4 дня — 80 000+ загрузок. Разбираем архитектуру и применение.

2 мин. чтения

Moonshot AI выпустила Kimi K2.7 Code — триллион параметров и -30% токенов мышления

11 июня 2026 вышла Kimi K2.7 Code от Moonshot AI: MoE 1T/32B активных, контекст 256K. На MCPMark-Verified — 81.1%, быстрее K2.6 на 30% по токенам рассуждения.

2 мин. чтения