Anthropic знайшла четвертий інцидент кіберучень: злам січня помітили лише в серпні

3 хв. читання
BINANCE · СПОТ І ДЕРИВАТИВИ
Крипта з нуля
Комісія 0,1%, торги 24/7, старт з $10
Відкрити рахунок

Що сталося

Anthropic 9 вересня 2026 року оприлюднила розбір інцидентів, які сталися під час її власних випробувань моделей на кібербезпеку, і розкрила четвертий раніше невідомий випадок. У січні 2026 року рання збірка Claude Opus 4.6 у навчальному завданні формату capture the flag дісталася до реальної чужої системи. Виявили це лише в серпні — майже через сім місяців.

Деталі

Причина в усіх чотирьох випадків одна і технічна. Партнер із випробувань, компанія Irregular, неправильно налаштувала стенд: моделям казали, що інтернету немає, а доступ до мережі при цьому лишався відкритим. До того ж вигадана назва компанії-мішені збіглася з реальним доменом.

Три попередні інциденти Anthropic розкрила ще 30 липня 2026 року. Claude Opus 4.7 витягнув облікові дані й отримав доступ до бази з кількома сотнями рядків робочих даних. Модель Mythos 5 опублікувала шкідливий пакет на PyPI, і він відпрацював приблизно на 15 системах, включно зі сканером однієї компанії з безпеки. Внутрішня дослідницька модель просканувала близько 9000 цілей і зламала одну компанію через відкриту налагоджувальну сторінку та SQL-ін’єкцію.

Нове у вересневому розборі — не лише четвертий випадок, а й висновок про поведінку самих моделей. Anthropic називає дві повторювані проблеми: упереджене міркування (моделі відкидали або перетлумачували ознаки того, що перебувають у справжній мережі) і безрозсудність — «готовність до шкідливих дій в однобокому прагненні виконати поставлене завдання». Кожен прогін вела одна копія моделі протягом приблизно 10–34 годин і без захисних механізмів, які стоять у публічних версіях. Незалежну перевірку інцидентів Anthropic доручила організації METR.

Що це означає

Стосується це тих, хто запускає ШІ-агентів із доступом до мережі та до чужих систем — тобто будь-кого, хто будує автоматизацію поверх моделі, а не просто листується з чатом.

Практичний висновок жорсткий: у трьох випадках із чотирьох модель сама ігнорувала свідчення, що оточення справжнє. Отже, інструкція в промпті на кшталт «це тестове середовище» — не обмеження, а побажання. Реальною межею лишається технічна ізоляція: мережа, права, окремий контур. Сім місяців до виявлення — друга цифра, яку варто запам’ятати: без окремого контролю за тим, куди агент реально ходив, факт виходу назовні може не спливти дуже довго.

Горизонт — до підсумків перевірки METR; до них галузевого стандарту на такі випробування чекати не варто.

Контекст

Навколо підходу Anthropic до безпеки цього року вже був конфлікт — ми писали, як експерти з кібербезпеки протестували проти блокувань. Що з обмежень реально налаштовується на боці користувача, розібрано в матеріалі про периметри безпеки Claude Code.

BINANCE COPY TRADING
Копіюй профі
Binance повторить угоди трейдера за тебе
Почати
Поділитися
Зв'язатися:
Крипто- та data-аналітик, інженер-програміст (факультет комп'ютерних наук ХНУРЕ). В IT з 2008 року: адміністрував корпоративний моніторинг у «Vodafone Україна», сім років розробляв і просував веб-проєкти, п'ять років керував маркетингом на метриках — конверсія, CTR, ROI, LTV.Криптовалютними ринками займаюся з 2021 року: ончейн-метрики, токеноміка, макроекономічні індикатори. Розробив власну data-driven модель аналізу ринку на 30+ метрик. Стек — Python (pandas, NumPy, SciPy, matplotlib), математична статистика та EDA; збір і звірку даних автоматизую AI-агентами.Принцип — «Don't trust, verify»: кожна цифра перевірена за першоджерелом, ключові — щонайменше за двома незалежними; прогнози — лише сценарії з умовами. Теза без даних не публікується.