Microsoft поставила вузьку модель проти фронтирних у пошуку вразливостей — і вдвічі зрізала рахунок за обчислення
Microsoft представила MAI-Cyber-1-Flash і платформу Project Perception: 96% на бенчмарку CyberGym і вдвічі менша вартість прогону проти попередньої конфігурації.
Корея виклала у відкритий доступ модель на 250 мільярдів параметрів, яка рахує як модель на 15 мільярдів
22 липня 2026 року Upstage оприлюднила Solar Open 2 — відкриту модель на 250 млрд параметрів із 15 млрд активних і контекстом у мільйон токенів.
Solar Open 2 на 250 млрд параметрів: працює як маленька
Огляд Solar Open2 250B від Upstage: гібридна MoE-архітектура, бенчмарки, реальна швидкість на DGX Spark, пастки ліцензії та квантування, підтримка мов.
Claude Opus 5 коштує як Opus 4.8 — а в незалежному рейтингу обійшла навіть Fable 5
Claude Opus 5 коштує як Opus 4.8, але обійшла Fable 5 у незалежному рейтингу. Розбираємо ціну, контекст, ефорт, бенчмарки та порівняння чотирьох моделей Anthropic.
Moonshot випустила Kimi K3 на 2,8 трлн параметрів — і знову налякала ринок чипів
Moonshot AI випустила Kimi K3 — найбільшу відкриту модель (2,8 трлн параметрів). Вона очолила Frontend Code Arena й пожвавила суперечки про економіку ШІ-будівництва.
GPT-5.6: чим різняться Sol, Terra і Luna та де Sol стає переплатою
Розбір трьох рівнів GPT-5.6: спільні характеристики, ціни за токени, поріг 272K, незалежні бенчмарки та чесна відповідь, коли досить Terra чи Luna.
DeepSeek V4 Pro і DSpark: що це насправді, скільки коштує й чи можна запустити вдома
Розбираємо DeepSeek V4 Pro та прискорювач DSpark: що це за модель, ціни API, бенчмарки вендора проти аудиту NIST і чи реально запустити локально.
Mistral відкрила Leanstral 1.5: 100% на формальній математиці та 5 знайдених багів
Mistral випустила open-source модель Leanstral 1.5 (Apache 2.0) для формальної верифікації в Lean 4: 100% на miniF2F і 5 раніше невідомих багів у 57 репозиторіях.
