Що сталося
SpaceXAI 12 серпня 2026 року випустила Grok 4.6. У зведеному рейтингу Artificial Analysis модель набрала 61 бал — стільки ж, скільки GPT-5.6 Sol в OpenAI, і на два бали менше, ніж Claude Opus 5. Ціна при цьому лишилася колишньою: $2 за мільйон вхідних токенів і $6 за мільйон вихідних.
Деталі
- Зростання до попередньої версії — п’ять балів: Grok 4.5 набирала 56.
- На агентському тесті GDPval-AA v2 модель посіла друге місце з рейтингом Ело 1753 і закриває складну задачу приблизно за 53 кроки проти приблизно 103 у Claude Opus 5.
- Інші результати, заявлені розробником: CursorBench v3.2 — 69,9%, DeepSWE v1.1 — 65,9%, FrontierCode v1.1 — 61,3%.
- Прайс конкурентів для порівняння: Claude Opus 5 — $5 і $25, GPT-5.6 Sol — $5 і $30 за мільйон токенів (на 12 серпня 2026).
- Пришвидшений варіант моделі коштує удвічі дорожче за звичайний.
- Доступ: власний API, редактор Cursor, Grok Build, а також OpenRouter, Vercel і Cloudflare. Перший тиждень у Grok Build і Cursor подвоєна включена квота.
Що це означає
Кого це стосується: тих, хто платить за токени — розробників на API і всіх, хто ганяє довгі агентські ланцюжки. Звичайному користувачеві чат-бота різниця в балах не видна.
Рахуємо реальну економію, а не різницю у прайсі. На вихідних токенах Grok дешевший за Opus 5 більш ніж учетверо. Поверх цього модель проходить ту саму задачу приблизно вдвічі коротше — а в агентських сценаріях кожен крок це ще один прогін контексту, тобто рахунок росте нелінійно. На повторюваних задачах розрив у вартості виходить кратним, і саме це, а не місце в таблиці, тут головне.
Де обережно: цифри бенчмарків дав сам розробник, незалежний тільки зведений індекс. Розрив у два бали з Claude Opus 5 — величина, яку на конкретній робочій задачі можна й не помітити, а можна впертися в неї першого ж дня. Горизонт нульовий: модель уже доступна, перевіряти варто на своїх задачах, а не за таблицею.
Контекст
Минулу версію SpaceXAI випустила 8 липня 2026 року з тією самою ціною у $2 і $6 — компанія другий реліз поспіль тримає прайс і добирає якість. Що в лінійки виходить на практиці, а що лише на папері, ми розбирали в огляді Grok 4.5.


