DeepSeek выложила V4 Flash под MIT: модель не выросла, но обошла собственную старшую Pro на агентских тестах
DeepSeek 31 июля выпустила финальную V4 Flash 0731: веса под MIT, 284 млрд параметров, контекст 1 млн токенов и цена втрое ниже медианы по классу.
DeepSeek V4 Flash 0731: модель не выросла, а обошла старшую Pro
Обзор DeepSeek V4 Flash 0731: что реально изменилось, цены API, честный разбор бенчмарков и требования к железу, если запускать веса у себя.
Вчетверо меньше — на один балл слабее: Thinking Machines выложила веса Inkling-Small
Thinking Machines открыла веса Inkling-Small на 276 млрд параметров. Модель отстала от старшей Inkling на один балл индекса, а памяти требует в разы меньше.
ROCm против CUDA: где Radeon догнал GeForce, а где потеряете время
Разбираем ROCm vs CUDA по задачам: инференс, дообучение, диффузия. Какие Radeon поддержаны, где Vulkan обгоняет ROCm и сколько стоит гигабайт VRAM.
Корея выложила в открытый доступ модель на 250 миллиардов параметров, которая считает как модель на 15 миллиардов
22 июля 2026 года Upstage опубликовала Solar Open 2 — открытую модель на 250 млрд параметров с 15 млрд активных и контекстом в миллион токенов.
Solar Open 2 на 250 млрд параметров: работает как маленькая
Обзор Solar Open2 250B от Upstage: гибридная MoE-архитектура, бенчмарки, реальная скорость на DGX Spark, ловушки лицензии и квантования, поддержка языков.
Alibaba показала Qwen3.8 на 2,4 трлн параметров — веса обещаны «скоро», даты нет
Alibaba анонсировала мультимодальную Qwen3.8: платный ранний доступ уже есть, открытых весов — ещё нет. Разбираем, что доступно сейчас и чего ждать.
Moonshot выпустила Kimi K3 на 2,8 трлн параметров — и снова напугала рынок чипов
Moonshot AI выпустила Kimi K3 — крупнейшую открытую модель (2,8 трлн параметров). Она возглавила Frontend Code Arena и оживила споры об экономике ИИ-стройки.
