Что произошло
Visa прогнала фронтир-модель Anthropic Claude Mythos по инфраструктуре собственной платёжной сети в поисках уязвимостей, а 28 июля открыла код инструмента, которым это делала. Обвязка называется Visa Vulnerability Agentic Harness (VVAH), лежит на GitHub под лицензией Apache 2.0 и к 29 июля собрала около 1,9 тыс. звёзд и 230 форков.
Детали
Обвязка (harness) — это не модель, а конвейер вокруг неё: что подать на вход, в каком порядке, как проверить ответ и что сделать с результатом. VVAH разбит на четыре фазы и одиннадцать стадий:Фаза Стадии Что делает Discovery & Modeling 1–3 Составляет карту поверхности атаки и моделирует угрозы в бизнес-контексте Deep Dive & Verification 4–6 Разбирает код несколькими «линзами» и состязательно перепроверяет находки Synthesis & Reporting 7–9 Убирает дубли и выдаёт структурированный отчёт Remediation & Validation 10–11 Предлагает патчи и проверяет, что они действительно чинят
Целевая метрика у Visa — MTTA (mean time to adapt), то есть время от «модель нашла эксплуатируемую дыру» до «проверенный фикс в проде». Ключевой шаг здесь — состязательная перепроверка: сырой прогон модели по большому репозиторию даёт много правдоподобного мусора, и без отдельной стадии опровержения отчёт становится бесполезным.
Формально VVAH мультимодельный: из коробки идут три адаптера — SDK Anthropic, терминальный агент Claude Code и OpenAI-совместимый интерфейс. Но полный цикл с автоматической починкой кода требует моделей Anthropic — у них есть нужные возможности редактирования файлов. Для запуска нужен Python 3.10 или новее и доступ к модели.
Масштаб находок Visa не раскрывает поштучно, но приводит контекст программы Project Glasswing, в рамках которой шла проверка: за первый месяц тестирования участники нашли более 10 тыс. уязвимостей высокой и критической серьёзности в широко используемом ПО. Отдельно по опенсорс-проектам предварительная версия Claude Mythos пометила 23 019 потенциальных проблем, из которых 6 202 оценены как высокие или критические.
Что это значит
Кого касается: разработчика и безопасника, у которых есть свой репозиторий и подписка на Claude, — инструмент можно забрать и запустить сегодня, лицензия Apache 2.0 это прямо разрешает. Практический выигрыш измеряется не «найдёт баги», а тем, сколько шума отсеется: 11 стадий против одного промпта — это и есть разница между списком гипотез и отчётом, с которым можно работать.
Риск тоже конкретный: авто-починка завязана на модели Anthropic, то есть бесплатная лицензия не отменяет привязку к одному вендору на самом ценном участке конвейера. Плюс расходы на токены — прогон по большому репозиторию через 11 стадий стоит ощутимо дороже разового вопроса модели.
И более общий вывод, который здесь виден лучше, чем в вендорских анонсах: результат дала не «умная модель», а конвейер вокруг неё. Мы разбирали это на примере разницы между моделью и обвязкой — один и тот же Claude в чате и в агентной оболочке выдаёт принципиально разный результат. Visa фактически подтвердила тезис на инфраструктуре, которая обслуживает платежи более чем в 200 странах.
Горизонт: код доступен сейчас; практический эффект для чужих кодовых баз станет виден по мере того, как обвязку начнут гонять вне Visa.



