DeepSeek V4.1-Flash вийшла з контекстом на 1 млн токенів і кешем по $0,003 за мільйон
DeepSeek випустила V4.1-Flash: 552 млрд параметрів MoE, контекст 1 млн токенів, ваги під MIT на Hugging Face і кешований ввід від $0,003 за 1 млн токенів.
Nvidia купує Hugging Face за $12,9 млрд: чипи NVIDIA не стануть обов’язковими
Nvidia офіційно купує Hugging Face за $12,93 млрд — найбільший хаб відкритих ШІ-моделей. Що обіцяє Хуанг розробникам і коли закриється угода.
RTX 5090 коштує $5090 замість $1999 — відеокарти подорожчали на 15% за місяць
Ціни на відеокарти зросли на 15% за місяць за даними з 10 країн. RTX 5090 продають за $5090 при рекомендованих $1999. Причина — дефіцит пам'яті через ШІ.
AMD Zen 6 отримав протокол HSMP v7 у Linux 7.3, а Ryzen AI Halo — драйвер підсвітки
У ядро Linux 7.3 прийняті x86-драйвери: протокол HSMP v7 для процесорів Zen 6 родини 1Ah Model 80H і драйвер amd_halo_led для міні-ПК Ryzen AI Halo.
OpenAI купує десятки тисяч Mac mini і Mac Studio, Anthropic орендує їх в AWS
The Information: OpenAI купила десятки тисяч Mac mini і Mac Studio для навчання агентів, що працюють у macOS. Anthropic орендує такі самі машини через AWS.
Jetson Orin Nano 2 — 78 TOPS, 8 ГБ і вдвічі швидше за Super: вихід до середини 2027
25 серпня 2026 року NVIDIA анонсувала Jetson Orin Nano 2: 78 TOPS, 8 ГБ пам'яті і вдвічі швидше за Orin Nano Super. Ціни ще немає, вихід у 2027 році.
Nutanix замінила Copilot і Claude кластером за $20 млн: окупність — рік
Голова Nutanix розповів 27 серпня 2026 року: розробники перейшли з Copilot і Claude на open-weight моделі у власному кластері за $20 млн. Рахуємо, коли це вигідно.
Qwen3.8-Flash-Next: 6 млрд активних із 125 і перевага над DeepSeek-V4-Flash у коді
26 серпня 2026 року команда Qwen випустила Qwen3.8-Flash-Next — прев'ю архітектури Qwen4: 125 млрд параметрів, 6 млрд активних і навчання в 9 разів дешевше.
