ai-models

Google DeepMind показала Gemini Robotics 2 — от настольной руки до гуманоида

DeepMind выпустила три модели Gemini Robotics 2 для управления роботами целиком. Google раскрыла проценты успеха по задачам — и они честно неровные.

3 мин. чтения

Вчетверо меньше — на один балл слабее: Thinking Machines выложила веса Inkling-Small

Thinking Machines открыла веса Inkling-Small на 276 млрд параметров. Модель отстала от старшей Inkling на один балл индекса, а памяти требует в разы меньше.

3 мин. чтения

Microsoft поставила узкую модель против фронтирных в поиске уязвимостей — и вдвое срезала счёт за вычисления

Microsoft представила MAI-Cyber-1-Flash и платформу Project Perception: 96% на бенчмарке CyberGym и вдвое меньшая стоимость прогона против прежней конфигурации.

3 мин. чтения

Корея выложила в открытый доступ модель на 250 миллиардов параметров, которая считает как модель на 15 миллиардов

22 июля 2026 года Upstage опубликовала Solar Open 2 — открытую модель на 250 млрд параметров с 15 млрд активных и контекстом в миллион токенов.

3 мин. чтения

Solar Open 2 на 250 млрд параметров: работает как маленькая

Обзор Solar Open2 250B от Upstage: гибридная MoE-архитектура, бенчмарки, реальная скорость на DGX Spark, ловушки лицензии и квантования, поддержка языков.

20 мин. чтения

Kimi K3 не довела до конца ни одной атаки из 41 — но и не пыталась отказаться от задания

Институты безопасности ИИ Британии и США протестировали Kimi K3 на кибератаках: 32% на ExploitBench против 24% у GLM-5.2 и ноль успехов из 41 задачи.

3 мин. чтения

Opus 5 стоит как Opus 4.8, а работает вдвое дешевле Fable — Anthropic продаёт не мощность, а экономию токенов

Anthropic выпустила Claude Opus 5 по цене Opus 4.8: $5 и $25 за миллион токенов. Модель приближается к Fable 5 вдвое дешевле и тратит на 26% меньше токенов.

3 мин. чтения

Claude Opus 5 стоит как Opus 4.8 — а в независимом рейтинге обошла даже Fable 5

Claude Opus 5 стоит как Opus 4.8, но обошла Fable 5 в независимом рейтинге. Разбираем цену, контекст, эффорт, бенчмарки и сравнение четырёх моделей Anthropic.

30 мин. чтения