Kimi K3 не довела до кінця жодної атаки з 41 — але й не намагалася відмовитися від завдання
Інститути безпеки ШІ Британії та США протестували Kimi K3 на кібератаках: 32% на ExploitBench проти 24% у GLM-5.2 і нуль успіхів із 41 завдання.
Opus 5 коштує як Opus 4.8, а працює вдвічі дешевше за Fable — Anthropic продає не потужність, а економію токенів
Anthropic випустила Claude Opus 5 за ціною Opus 4.8: $5 і $25 за мільйон токенів. Модель наближається до Fable 5 удвічі дешевше і витрачає на 26% менше токенів.
Claude Opus 5 коштує як Opus 4.8 — а в незалежному рейтингу обійшла навіть Fable 5
Claude Opus 5 коштує як Opus 4.8, але обійшла Fable 5 у незалежному рейтингу. Розбираємо ціну, контекст, ефорт, бенчмарки та порівняння чотирьох моделей Anthropic.
Microsoft вивів свої моделі MAI-Image і MAI-Voice у публічне прев’ю — економія до 89% проти OpenAI
Microsoft 23 липня 2026 відкрила публічне прев'ю MAI-Image-2.5-Pro і MAI-Voice-2-Flash — заявлена економія GPU до 89% проти рішень на базі OpenAI.
Один агент чи кілька: як обрати мультиагентну архітектуру
Коли потрібна мультиагентна система, а коли досить одного агента: типи координації, дерево рішень із 4 питань Anthropic, реальні кейси та чесні провали.
П’ять патернів агентних систем: механіка, приклади та ціна кожного
П'ять патернів агентних систем ШІ від Anthropic: ланцюжок промптів, маршрутизація, паралелізація, оркестратор-воркери й оцінювач-оптимізатор — з прикладами і ціною.
Воркфлоу проти ШІ-агента: як обрати і не переплатити за автономність
Чим воркфлоу відрізняється від ШІ-агента за каноном Anthropic, коли агент потрібен, а коли це переускладнення, економіка вибору і регуляторний аргумент EU AI Act.
Alibaba показала Qwen3.8 на 2,4 трлн параметрів — ваги обіцяні «скоро», дати немає
Alibaba анонсувала мультимодальну Qwen3.8: платний ранній доступ уже є, відкритих ваг — ще ні. Розбираємо, що доступно зараз і чого реально чекати.