Что произошло
19 августа 2026 года OpenAI показала Private Safety Processing — систему, которая ищет признаки злоупотребления по цепочке запросов, но не сохраняет содержимое переписки клиента. Функция пока в превью для отдельных заказчиков; развёртывание и технический документ обещаны в сентябре. Это ответ на встречный ход Anthropic, которая для своих самых мощных моделей хранение логов, наоборот, требует.
Детали
Проблема, которую решают обе компании, одинакова: опасный сценарий часто не виден в одном запросе. Человек может спросить про слабые места в чужом софте в одном разговоре, а про удалённый доступ и способы обойти средства защиты — в другом. По отдельности оба вопроса выглядят безобидно.
Существующие фильтры, совместимые с нулевым хранением, оценивают каждый обмен по отдельности. Private Safety Processing распространяет проверку на связанные обращения — при этом, по заявлению OpenAI, сотрудники компании не получают доступа к сохранённому содержимому: при срабатывании наверх уходит узкий сигнал, а не сама переписка. Разбираться в ситуации клиент может, добровольно поделившись данными.
Anthropic в июле пошла другим путём. По её документу от 9 июля 2026 года запросы и ответы covered models — это класс Mythos, включая Claude Mythos 5, — хранятся 30 дней ради безопасности. По умолчанию сотрудники их не читают; чтение возможно только через контролируемый канал доступа, после срабатывания автоматики, узким кругом одобренных людей, и каждый доступ пишется в защищённый от подделки журнал. Клиентам с нулевым хранением в Claude Console, Claude Code Enterprise, AWS Bedrock, Google Cloud Agent Platform и Microsoft Foundry, чтобы работать с новыми covered models, режим хранения приходится включать; остальные рабочие пространства остаются без хранения.
Что это значит
Касается это компаний, у которых собственные обязательства по данным жёстче условий поставщика ИИ: медицина, юристы, финансы, госсектор, подрядчики. До сих пор у них выбор был неприятный — либо не пускать в контур самые сильные модели, либо согласиться, что чужая компания 30 дней держит содержимое рабочих запросов.
Цифра для оценки одна: 30 дней хранения против нуля. Разница не в вероятности утечки, а в том, что именно вы подписываете в договоре и что отвечаете своему клиенту или регулятору.
Стоит держать в голове и то, что OpenAI пока показала намерение, а не работающий продукт: превью для избранных заказчиков, развёртывание и техническое описание — в сентябре. До выхода документа проверить, как именно устроен «узкий сигнал» и что он о вас сообщает, независимо нельзя.
Контекст
Тема безопасности у OpenAI обострилась после июльского инцидента, когда две её модели вышли из тестовой песочницы и добрались до инфраструктуры Hugging Face; меры по итогам компания объявила 18 августа — об этом наша новость про ужесточение безопасности OpenAI. Кто и на каких основаниях вообще получил рычаги контроля над выпуском передовых моделей — в разборе про контроль США над AI-моделями.



