ai-models

Anthropic: Claude у ролі автодослідника закрив 10 типів збоїв вирівнювання

Anthropic опублікувала роботу про автоматичного дослідника вирівнювання: Claude сам знайшов методи проти всіх десяти типів збоїв і обійшов людей на обмані.

3 хв. читання

Qwen3.8-Flash-Next: 6 млрд активних із 125 і перевага над DeepSeek-V4-Flash у коді

26 серпня 2026 року команда Qwen випустила Qwen3.8-Flash-Next — прев'ю архітектури Qwen4: 125 млрд параметрів, 6 млрд активних і навчання в 9 разів дешевше.

4 хв. читання

Gemini 3.5 Transcribe: 85+ мов, WER 2,6% і близько $0,30 за годину аудіо в API

26 серпня 2026 року Google випустила Gemini 3.5 Transcribe — розпізнавання мовлення 85+ мовами: прибирає слова-паразити й виправляє обмовки. Ціни та кому підійде.

4 хв. читання

DeepSeek V4-Flash-Vision-Exp обходить Opus 4.8 на двох тестах, але ваг немає

DeepSeek випустив експериментальну мультимодальну модель V4-Flash-Vision-Exp: ціна як у V4-Flash, але ваг у відкритому доступі поки немає — лише API.

3 хв. читання

Pew вивчив 490 тисяч сторінок: сліди ШІ є у 35% створених після запуску ChatGPT

Pew Research перевірив 490 тисяч англомовних сторінок: 35% створених після виходу ChatGPT мають ознаки авторства ШІ. Що показав замір і де його межа.

3 хв. читання

GLM-5.3 знайшла 1097 критичних багів — Z.ai притримала ваги на два тижні

GLM-5.3 від Z.ai набрала 60 балів Artificial Analysis і ділить перше місце серед відкритих моделей. Відкриті ваги затримали через кіберможливості.

3 хв. читання

Нейромережа для трейдингу: п’ять завдань, де вона працює, і одне, де ні

Нейромережа для трейдингу розбирає новини, звіти та код стратегії, але ціну не передбачає. Розбір завдань із перевірюваним результатом, витрат і ознак розводу.

26 хв. читання

Ціна секунди ШІ-відео: Veo 3.1, Kling 3.0 і Runway з урахуванням браку

Офіційні ціни Veo 3.1, Kling 3.0 і Runway на 15 серпня 2026 року та розрахунок ціни секунди готового відео з поправкою на невдалі генерації й монтажний відбір.

25 хв. читання