Claude Code включает Auto Mode по умолчанию: 89% опасных команд ловит классификатор

3 мин. чтения
BYBIT COPY TRADING
Копируй профи
Bybit повторит сделки трейдера за тебя
Начать

Что произошло

Anthropic объявила, что с 14 августа 2026 года режим Auto Mode станет для Claude Code настройкой по умолчанию на тарифах Pro, Max и Team. Корпоративный тариф Enterprise пока остаётся на ручном подтверждении — там режим включают сами. В Auto Mode агент не спрашивает разрешения на каждое действие: вызовы инструментов проходят через классификатор, и подтверждения требуют только необратимые, разрушительные или выходящие за пределы рабочей среды операции.

Детали

Anthropic обосновывает решение своим исследованием на 1053 платных тестировщиках-профессионалах. Цифры из официального блога компании:

Что мерилиРучное подтверждениеAuto Mode
Пойманные опасные команды13,6% (143 из 1053)89% (937 из 1053)
Вредные непреднамеренные действия6,3% сессий2,4% сессий

Отдельно проверяли устойчивость к «prompt injection» — попыткам подсунуть агенту вредоносную инструкцию через содержимое файла или страницы. Из 720 атак против моделей Claude Fable 5, Opus 5 и Sonnet 5 в этом режиме не прошла ни одна. У GPT-5.6 Sol в сопоставимом режиме автопроверки успешными оказались 5,83% попыток. Независимое состязательное тестирование после доработок дало 7% пропусков.

Побочный результат: команды в тесте выпускали примерно на 25% больше пул-реквестов.

Отключить режим можно на месте — Shift+Tab в терминале или выпадающее меню в десктопном приложении; администратор организации закрывает его параметром disableAutoMode в управляемых настройках.

Что это значит

Касается это разработчиков на тарифах Pro, Max и Team, у которых Claude Code уже стоит в рабочем контуре: 14 августа поведение агента изменится само, без их участия. Практический риск не в самом режиме, а в цифре 7% пропусков у независимых тестировщиков — то есть примерно каждая четырнадцатая опасная операция классификатор не остановит. Anthropic это признаёт прямо и рекомендует по-прежнему просматривать действия агента вручную, когда правки идут в боевую инфраструктуру.

Сравнение 89% против 13,6% стоит читать аккуратно: низкий человеческий результат — это не «люди невнимательные», а следствие усталости от подтверждений. Когда агент спрашивает разрешения десятки раз за сессию, человек начинает нажимать «да» не глядя. Автоматика не столько умнее, сколько не устаёт.

Горизонт — 14 августа 2026 года. Что стоит сделать до этой даты: решить, где у вас проходит граница «сюда агент сам не лезет», и настроить режимы доступа Claude Code под свой проект, а не разбираться с этим постфактум.

BYBIT EARN
Крипта лежит?
Bybit Earn: процент капает каждый день
Открыть Earn
Поделиться
Связаться:
Крипто- и data-аналитик, инженер-программист (факультет компьютерных наук ХНУРЭ). В IT с 2008 года: администрировал корпоративный мониторинг в «Vodafone Украина», семь лет разрабатывал и продвигал веб-проекты, пять лет руководил маркетингом на метриках — конверсия, CTR, ROI, LTV.Криптовалютными рынками занимаюсь с 2021 года: ончейн-метрики, токеномика, макроэкономические индикаторы. Разработал собственную data-driven модель анализа рынка на 30+ метрик. Стек — Python (pandas, NumPy, SciPy, matplotlib), математическая статистика и EDA; сбор и сверку данных автоматизирую AI-агентами.Принцип — «Don't trust, verify»: каждая цифра проверена по первоисточнику, ключевые — минимум по двум независимым; прогнозы — только сценарии с условиями. Тезис без данных не публикуется.