local-llm

DeepSeek V4.1-Flash вийшла з контекстом на 1 млн токенів і кешем по $0,003 за мільйон

DeepSeek випустила V4.1-Flash: 552 млрд параметрів MoE, контекст 1 млн токенів, ваги під MIT на Hugging Face і кешований ввід від $0,003 за 1 млн токенів.

3 хв. читання

Nvidia купує Hugging Face за $12,9 млрд: чипи NVIDIA не стануть обов’язковими

Nvidia офіційно купує Hugging Face за $12,93 млрд — найбільший хаб відкритих ШІ-моделей. Що обіцяє Хуанг розробникам і коли закриється угода.

3 хв. читання

RTX 5090 коштує $5090 замість $1999 — відеокарти подорожчали на 15% за місяць

Ціни на відеокарти зросли на 15% за місяць за даними з 10 країн. RTX 5090 продають за $5090 при рекомендованих $1999. Причина — дефіцит пам'яті через ШІ.

3 хв. читання

AMD Zen 6 отримав протокол HSMP v7 у Linux 7.3, а Ryzen AI Halo — драйвер підсвітки

У ядро Linux 7.3 прийняті x86-драйвери: протокол HSMP v7 для процесорів Zen 6 родини 1Ah Model 80H і драйвер amd_halo_led для міні-ПК Ryzen AI Halo.

3 хв. читання

OpenAI купує десятки тисяч Mac mini і Mac Studio, Anthropic орендує їх в AWS

The Information: OpenAI купила десятки тисяч Mac mini і Mac Studio для навчання агентів, що працюють у macOS. Anthropic орендує такі самі машини через AWS.

3 хв. читання

Jetson Orin Nano 2 — 78 TOPS, 8 ГБ і вдвічі швидше за Super: вихід до середини 2027

25 серпня 2026 року NVIDIA анонсувала Jetson Orin Nano 2: 78 TOPS, 8 ГБ пам'яті і вдвічі швидше за Orin Nano Super. Ціни ще немає, вихід у 2027 році.

4 хв. читання

Nutanix замінила Copilot і Claude кластером за $20 млн: окупність — рік

Голова Nutanix розповів 27 серпня 2026 року: розробники перейшли з Copilot і Claude на open-weight моделі у власному кластері за $20 млн. Рахуємо, коли це вигідно.

4 хв. читання

Qwen3.8-Flash-Next: 6 млрд активних із 125 і перевага над DeepSeek-V4-Flash у коді

26 серпня 2026 року команда Qwen випустила Qwen3.8-Flash-Next — прев'ю архітектури Qwen4: 125 млрд параметрів, 6 млрд активних і навчання в 9 разів дешевше.

4 хв. читання