llama-cpp

Ollama підняла Series B на $65 млн — чому це важливо для локального ШІ

Раннер моделей з відкритими вагами Ollama закрив Series B на $65 млн (Theory Ventures) і виріс до 8,9 млн розробників. Що це означає для локального ШІ.

2 хв. читання

GPT-OSS на своєму ПК: перші відкриті моделі OpenAI за роки

Відкриті моделі OpenAI на власному ПК: скільки треба VRAM для 20B і 120B, які кванти обрати, як налаштувати глибину міркування і не спіткнутись об Harmony.

21 хв. читання

Phi-4 на своєму ПК: 14B-модель Microsoft проти гігантів

Огляд Phi-4 для локального запуску у 2026: уся лінійка, таблиця VRAM, чому 14B б'є GPT-4o у STEM, чесно про контекст 16K, українську мову та ліцензію MIT.

19 хв. читання

DeepSeek-R1 на своєму ПК: модель, що міркує, через дистиляти

Як запустити DeepSeek-R1 локально у 2026: чому 671B не для дому, який дистилят обрати під VRAM, таблиця швидкості, ліцензія MIT і чесно про цензуру.

21 хв. читання

Llama на власному комп’ютері: розбір версій, заліза та ліцензії у 2026

Яку Llama запустити вдома: розбір версій і вимог до VRAM, пастка MoE у Scout, межі ліцензії Meta та запуск через Ollama, LM Studio або llama.cpp.

27 хв. читання

Unsloth виклала diffusiongemma-26B-GGUF — 80 000 завантажень за 4 дні, дифузійний LLM на Gemma

Unsloth виклала GGUF diffusiongemma-26B ~10 червня 2026: дифузійний LLM на Gemma для llama.cpp. За 4 дні — 80 000+ завантажень. Розбираємо архітектуру і застосування.

2 хв. читання

Moonshot AI випустила Kimi K2.7 Code — трильйон параметрів і -30% токенів мислення

11 червня 2026 вийшла Kimi K2.7 Code від Moonshot AI: MoE 1T/32B активних, контекст 256K. MCPMark-Verified — 81.1%, менше thinking-токенів на 30% порівняно з K2.6.

2 хв. читання