Gemini 3.5 Transcribe: 85+ языков, WER 2,6% и около $0,30 за час аудио в API
26 августа 2026 года Google выпустила Gemini 3.5 Transcribe — модель речь-в-текст на 85+ языках: убирает слова-паразиты и правит оговорки. Цены и кому подходит.
4 мин. чтения
Нейросеть для видеомонтажа: 7 работ монтажёра — что ИИ уже делает сам, а что нет
Семь работ монтажёра — от нарезки до озвучки: что нейросеть для видеомонтажа делает сама, где именно ломается и сколько стоит час готового видео.
37 мин. чтения
Голосовой ввод в Claude Code: как диктовать промпты и вставлять скриншоты
Как ускорить работу в Claude Code голосом и картинками: встроенный /voice с поддержкой русского и украинского, Whisper и Wispr Flow, вставка скриншотов и макетов.
17 мин. чтения
Wispr Flow или свой Whisper: облачная и офлайн-диктовка
Разбираем Wispr Flow и локальную диктовку на Whisper: тарифы, почему Privacy Mode не офлайн, требования к железу и пошаговая установка офлайн-диктовки.
24 мин. чтения
