local-llm

DeepSeek виклала V4 Flash під MIT: модель не виросла, але обійшла власну старшу Pro на агентських тестах

DeepSeek 31 липня випустила фінальну V4 Flash 0731: ваги під MIT, 284 млрд параметрів, контекст 1 млн токенів і ціна втричі нижча за медіану по класу.

3 хв. читання

DeepSeek V4 Flash 0731: модель не виросла, а обійшла старшу Pro

Огляд DeepSeek V4 Flash 0731: що реально змінилося, ціни API, чесний розбір бенчмарків і вимоги до заліза, якщо запускати ваги в себе.

20 хв. читання

Вчетверо менша — на один бал слабша: Thinking Machines виклала ваги Inkling-Small

Thinking Machines відкрила ваги Inkling-Small на 276 млрд параметрів. Модель відстала від старшої Inkling на один бал індексу, а памʼяті потребує значно менше.

3 хв. читання

ROCm проти CUDA: де Radeon наздогнав GeForce, а де втратите час

Розбираємо ROCm vs CUDA за завданнями: інференс, донавчання, дифузія. Які Radeon підтримані, де Vulkan обганяє ROCm і скільки коштує гігабайт відеопамʼяті.

24 хв. читання

Корея виклала у відкритий доступ модель на 250 мільярдів параметрів, яка рахує як модель на 15 мільярдів

22 липня 2026 року Upstage оприлюднила Solar Open 2 — відкриту модель на 250 млрд параметрів із 15 млрд активних і контекстом у мільйон токенів.

3 хв. читання

Solar Open 2 на 250 млрд параметрів: працює як маленька

Огляд Solar Open2 250B від Upstage: гібридна MoE-архітектура, бенчмарки, реальна швидкість на DGX Spark, пастки ліцензії та квантування, підтримка мов.

20 хв. читання

Alibaba показала Qwen3.8 на 2,4 трлн параметрів — ваги обіцяні «скоро», дати немає

Alibaba анонсувала мультимодальну Qwen3.8: платний ранній доступ уже є, відкритих ваг — ще ні. Розбираємо, що доступно зараз і чого реально чекати.

4 хв. читання

Moonshot випустила Kimi K3 на 2,8 трлн параметрів — і знову налякала ринок чипів

Moonshot AI випустила Kimi K3 — найбільшу відкриту модель (2,8 трлн параметрів). Вона очолила Frontend Code Arena й пожвавила суперечки про економіку ШІ-будівництва.

2 хв. читання