Google DeepMind показала Gemini Robotics 2 — от настольной руки до гуманоида
DeepMind выпустила три модели Gemini Robotics 2 для управления роботами целиком. Google раскрыла проценты успеха по задачам — и они честно неровные.
Вчетверо меньше — на один балл слабее: Thinking Machines выложила веса Inkling-Small
Thinking Machines открыла веса Inkling-Small на 276 млрд параметров. Модель отстала от старшей Inkling на один балл индекса, а памяти требует в разы меньше.
Microsoft поставила узкую модель против фронтирных в поиске уязвимостей — и вдвое срезала счёт за вычисления
Microsoft представила MAI-Cyber-1-Flash и платформу Project Perception: 96% на бенчмарке CyberGym и вдвое меньшая стоимость прогона против прежней конфигурации.
Корея выложила в открытый доступ модель на 250 миллиардов параметров, которая считает как модель на 15 миллиардов
22 июля 2026 года Upstage опубликовала Solar Open 2 — открытую модель на 250 млрд параметров с 15 млрд активных и контекстом в миллион токенов.
Solar Open 2 на 250 млрд параметров: работает как маленькая
Обзор Solar Open2 250B от Upstage: гибридная MoE-архитектура, бенчмарки, реальная скорость на DGX Spark, ловушки лицензии и квантования, поддержка языков.
Kimi K3 не довела до конца ни одной атаки из 41 — но и не пыталась отказаться от задания
Институты безопасности ИИ Британии и США протестировали Kimi K3 на кибератаках: 32% на ExploitBench против 24% у GLM-5.2 и ноль успехов из 41 задачи.
Opus 5 стоит как Opus 4.8, а работает вдвое дешевле Fable — Anthropic продаёт не мощность, а экономию токенов
Anthropic выпустила Claude Opus 5 по цене Opus 4.8: $5 и $25 за миллион токенов. Модель приближается к Fable 5 вдвое дешевле и тратит на 26% меньше токенов.
Claude Opus 5 стоит как Opus 4.8 — а в независимом рейтинге обошла даже Fable 5
Claude Opus 5 стоит как Opus 4.8, но обошла Fable 5 в независимом рейтинге. Разбираем цену, контекст, эффорт, бенчмарки и сравнение четырёх моделей Anthropic.
