Claude Code вмикає Auto Mode: класифікатор ловить 89% небезпечних команд

3 хв. читання
BINANCE COPY TRADING
Копіюй профі
Binance повторить угоди трейдера за тебе
Почати

Що сталося

Anthropic оголосила, що з 14 серпня 2026 року режим Auto Mode стане для Claude Code налаштуванням за умовчанням на тарифах Pro, Max і Team. Корпоративний тариф Enterprise поки лишається на ручному підтвердженні — там режим вмикають самі. У Auto Mode агент не питає дозволу на кожну дію: виклики інструментів проходять через класифікатор, і підтвердження потребують лише незворотні, руйнівні або такі, що виходять за межі робочого середовища, операції.

Деталі

Anthropic обґрунтовує рішення власним дослідженням на 1053 платних тестувальниках-професіоналах. Цифри з офіційного блогу компанії:

Що вимірювалиРучне підтвердженняAuto Mode
Спіймані небезпечні команди13,6% (143 з 1053)89% (937 з 1053)
Шкідливі ненавмисні дії6,3% сесій2,4% сесій

Окремо перевіряли стійкість до «prompt injection» — спроб підсунути агентові шкідливу інструкцію через вміст файлу чи сторінки. З 720 атак проти моделей Claude Fable 5, Opus 5 і Sonnet 5 у цьому режимі не пройшла жодна. У GPT-5.6 Sol у зіставному режимі автоперевірки успішними виявилися 5,83% спроб. Незалежне змагальне тестування після доопрацювань дало 7% пропусків.

Побічний результат: команди в тесті випускали приблизно на 25% більше пул-реквестів.

Вимкнути режим можна на місці — Shift+Tab у терміналі або спадне меню в застосунку для комп’ютера; адміністратор організації закриває його параметром disableAutoMode у керованих налаштуваннях.

Що це означає

Стосується це розробників на тарифах Pro, Max і Team, у яких Claude Code уже стоїть у робочому контурі: 14 серпня поведінка агента зміниться сама, без їхньої участі. Практичний ризик не в самому режимі, а в цифрі 7% пропусків у незалежних тестувальників — тобто приблизно кожну чотирнадцяту небезпечну операцію класифікатор не зупинить. Anthropic це визнає прямо й радить, як і раніше, переглядати дії агента вручну, коли правки йдуть у бойову інфраструктуру.

Порівняння 89% проти 13,6% варто читати обережно: низький людський результат — це не «люди неуважні», а наслідок утоми від підтверджень. Коли агент питає дозволу десятки разів за сесію, людина починає натискати «так» не дивлячись. Автоматика не так розумніша, як не втомлюється.

Горизонт — 14 серпня 2026 року. Що варто зробити до цієї дати: вирішити, де у вас проходить межа «сюди агент сам не лізе», і налаштувати режими доступу Claude Code під свій проєкт, а не розбиратися з цим постфактум.

BINANCE SIMPLE EARN
Крипта лежить?
Simple Earn: відсоток нараховується щодня
Відкрити Earn
Поділитися
Зв'язатися:
Крипто- та data-аналітик, інженер-програміст (факультет комп'ютерних наук ХНУРЕ). В IT з 2008 року: адміністрував корпоративний моніторинг у «Vodafone Україна», сім років розробляв і просував веб-проєкти, п'ять років керував маркетингом на метриках — конверсія, CTR, ROI, LTV.Криптовалютними ринками займаюся з 2021 року: ончейн-метрики, токеноміка, макроекономічні індикатори. Розробив власну data-driven модель аналізу ринку на 30+ метрик. Стек — Python (pandas, NumPy, SciPy, matplotlib), математична статистика та EDA; збір і звірку даних автоматизую AI-агентами.Принцип — «Don't trust, verify»: кожна цифра перевірена за першоджерелом, ключові — щонайменше за двома незалежними; прогнози — лише сценарії з умовами. Теза без даних не публікується.