Что произошло
SpaceXAI 12 августа 2026 года выпустила Grok 4.6. В сводном рейтинге Artificial Analysis модель набрала 61 балл — столько же, сколько GPT-5.6 Sol у OpenAI, и на два балла меньше, чем Claude Opus 5. Цена при этом осталась прежней: $2 за миллион входных токенов и $6 за миллион выходных.
Детали
- Рост к предыдущей версии — пять баллов: Grok 4.5 набирала 56.
- На агентском тесте GDPval-AA v2 модель заняла второе место с рейтингом Эло 1753 и закрывает сложную задачу примерно за 53 шага против примерно 103 у Claude Opus 5.
- Прочие результаты, заявленные разработчиком: CursorBench v3.2 — 69,9%, DeepSWE v1.1 — 65,9%, FrontierCode v1.1 — 61,3%.
- Прайс конкурентов для сравнения: Claude Opus 5 — $5 и $25, GPT-5.6 Sol — $5 и $30 за миллион токенов (на 12 августа 2026).
- Ускоренный вариант модели стоит вдвое дороже обычного.
- Доступ: собственный API, редактор Cursor, Grok Build, а также OpenRouter, Vercel и Cloudflare. Первую неделю в Grok Build и Cursor удвоена включённая квота.
Что это значит
Кого касается: тех, кто платит за токены — разработчиков на API и всех, кто гоняет длинные агентские цепочки. Обычному пользователю чат-бота разница в баллах не видна.
Считаем реальную экономию, а не разницу в прайсе. На выходных токенах Grok дешевле Opus 5 больше чем вчетверо. Поверх этого модель проходит ту же задачу примерно вдвое короче — а в агентских сценариях каждый шаг это ещё один прогон контекста, то есть счёт растёт нелинейно. На повторяющихся задачах разрыв в стоимости получается кратным, и именно это, а не место в таблице, здесь главное.
Где осторожно: цифры бенчмарков дал сам разработчик, независим только сводный индекс. Разрыв в два балла с Claude Opus 5 — величина, которую на конкретной рабочей задаче можно и не заметить, а можно упереться в неё в первый же день. Горизонт нулевой: модель уже доступна, проверять стоит на своих задачах, а не по таблице.
Контекст
Прошлую версию SpaceXAI выпустила 8 июля 2026 года с той же ценой в $2 и $6 — компания второй релиз подряд держит прайс и добирает качество. Что у линейки получается на практике, а что только на бумаге, мы разбирали в обзоре Grok 4.5.



