Nvidia RTX Spark N1X обошёл Ryzen AI Max+ 395 в многопотоке Geekbench
В базе Geekbench 7 нашли две системы на ARM-чипе Nvidia RTX Spark N1X. Что показали 18- и 20-ядерная версии и что эти баллы значат для локального запуска ИИ.
Qwen 3.8-Max: чем больше усилия, тем хуже результат — и почему баллы не равны счёту
Независимый прогон VulcanBench: Qwen 3.8-Max берёт 81,2% задач на низком усилии и 55,1% на заводской настройке. Провалы — не ошибки, а незаконченные прогоны.
DeepSeek выложила V4 Flash под MIT: модель не выросла, но обошла собственную старшую Pro на агентских тестах
DeepSeek 31 июля выпустила финальную V4 Flash 0731: веса под MIT, 284 млрд параметров, контекст 1 млн токенов и цена втрое ниже медианы по классу.
DeepSeek V4 Flash 0731: модель не выросла, а обошла старшую Pro
Обзор DeepSeek V4 Flash 0731: что реально изменилось, цены API, честный разбор бенчмарков и требования к железу, если запускать веса у себя.
OpenAI назвала следующее семейство моделей Astra и выложила решения десяти открытых задач с доказательствами в Lean
OpenAI 1 августа опубликовала решения десяти нерешённых математических задач от внутренней версии Astra. Каждое доказательство формализовано в Lean.
Вчетверо меньше — на один балл слабее: Thinking Machines выложила веса Inkling-Small
Thinking Machines открыла веса Inkling-Small на 276 млрд параметров. Модель отстала от старшей Inkling на один балл индекса, а памяти требует в разы меньше.
Microsoft поставила узкую модель против фронтирных в поиске уязвимостей — и вдвое срезала счёт за вычисления
Microsoft представила MAI-Cyber-1-Flash и платформу Project Perception: 96% на бенчмарке CyberGym и вдвое меньшая стоимость прогона против прежней конфигурации.
Корея выложила в открытый доступ модель на 250 миллиардов параметров, которая считает как модель на 15 миллиардов
22 июля 2026 года Upstage опубликовала Solar Open 2 — открытую модель на 250 млрд параметров с 15 млрд активных и контекстом в миллион токенов.
