Anthropic: Claude у ролі автодослідника закрив 10 типів збоїв вирівнювання
Anthropic опублікувала роботу про автоматичного дослідника вирівнювання: Claude сам знайшов методи проти всіх десяти типів збоїв і обійшов людей на обмані.
Qwen3.8-Flash-Next: 6 млрд активних із 125 і перевага над DeepSeek-V4-Flash у коді
26 серпня 2026 року команда Qwen випустила Qwen3.8-Flash-Next — прев'ю архітектури Qwen4: 125 млрд параметрів, 6 млрд активних і навчання в 9 разів дешевше.
Gemini 3.5 Transcribe: 85+ мов, WER 2,6% і близько $0,30 за годину аудіо в API
26 серпня 2026 року Google випустила Gemini 3.5 Transcribe — розпізнавання мовлення 85+ мовами: прибирає слова-паразити й виправляє обмовки. Ціни та кому підійде.
DeepSeek V4-Flash-Vision-Exp обходить Opus 4.8 на двох тестах, але ваг немає
DeepSeek випустив експериментальну мультимодальну модель V4-Flash-Vision-Exp: ціна як у V4-Flash, але ваг у відкритому доступі поки немає — лише API.
Pew вивчив 490 тисяч сторінок: сліди ШІ є у 35% створених після запуску ChatGPT
Pew Research перевірив 490 тисяч англомовних сторінок: 35% створених після виходу ChatGPT мають ознаки авторства ШІ. Що показав замір і де його межа.
GLM-5.3 знайшла 1097 критичних багів — Z.ai притримала ваги на два тижні
GLM-5.3 від Z.ai набрала 60 балів Artificial Analysis і ділить перше місце серед відкритих моделей. Відкриті ваги затримали через кіберможливості.
Нейромережа для трейдингу: п’ять завдань, де вона працює, і одне, де ні
Нейромережа для трейдингу розбирає новини, звіти та код стратегії, але ціну не передбачає. Розбір завдань із перевірюваним результатом, витрат і ознак розводу.
Ціна секунди ШІ-відео: Veo 3.1, Kling 3.0 і Runway з урахуванням браку
Офіційні ціни Veo 3.1, Kling 3.0 і Runway на 15 серпня 2026 року та розрахунок ціни секунди готового відео з поправкою на невдалі генерації й монтажний відбір.
