quantization

Unsloth выложила diffusiongemma-26B-GGUF — 80 000 загрузок за 4 дня, диффузионный LLM на Gemma

Unsloth выложила GGUF diffusiongemma-26B ~10 июня 2026: диффузионный LLM на Gemma для llama.cpp. За 4 дня — 80 000+ загрузок. Разбираем архитектуру и применение.

2 мин. чтения

MiniMax выпустила MiniMax-M3 — MoE-модель с MSA для миллиона токенов и режимами думания

MiniMax-M3 (HF, 2 июня 2026): MoE + Sparse Attention для миллиона токенов. Мультимодальная — текст, видео, изображения. Together $1,2/млн вых. токенов.

2 мин. чтения

Moonshot AI выпустила Kimi K2.7 Code — триллион параметров и -30% токенов мышления

11 июня 2026 вышла Kimi K2.7 Code от Moonshot AI: MoE 1T/32B активных, контекст 256K. На MCPMark-Verified — 81.1%, быстрее K2.6 на 30% по токенам рассуждения.

2 мин. чтения