Що сталося
19 серпня 2026 року OpenAI показала Private Safety Processing — систему, яка шукає ознаки зловживання по ланцюжку запитів, але не зберігає вміст листування клієнта. Функція поки що в превʼю для окремих замовників; розгортання й технічний документ обіцяні у вересні. Це відповідь на зустрічний хід Anthropic, яка для своїх найпотужніших моделей зберігання логів, навпаки, вимагає.
Деталі
Проблема, яку розв’язують обидві компанії, однакова: небезпечний сценарій часто не видно в одному запиті. Людина може запитати про слабкі місця в чужому софті в одній розмові, а про віддалений доступ і способи обійти засоби захисту — в іншій. Окремо обидва питання виглядають безневинно.
Наявні фільтри, сумісні з нульовим зберіганням, оцінюють кожен обмін окремо. Private Safety Processing поширює перевірку на пов’язані звернення — при цьому, за заявою OpenAI, працівники компанії не отримують доступу до збереженого вмісту: коли система спрацьовує, нагору йде вузький сигнал, а не саме листування. Розбиратися в ситуації клієнт може, добровільно поділившись даними.
Anthropic у липні пішла іншим шляхом. За її документом від 9 липня 2026 року запити й відповіді covered models — це клас Mythos, включно з Claude Mythos 5, — зберігаються 30 днів заради безпеки. За замовчуванням працівники їх не читають; читання можливе лише через контрольований канал доступу, після спрацювання автоматики, вузьким колом схвалених людей, і кожен доступ пишеться в захищений від підробки журнал. Клієнтам із нульовим зберіганням у Claude Console, Claude Code Enterprise, AWS Bedrock, Google Cloud Agent Platform і Microsoft Foundry, щоб працювати з новими covered models, режим зберігання доводиться вмикати; решта робочих просторів залишаються без зберігання.
Що це означає
Стосується це компаній, у яких власні зобов’язання щодо даних жорсткіші за умови постачальника ШІ: медицина, юристи, фінанси, держсектор, підрядники. Досі вибір у них був неприємний — або не пускати в контур найсильніші моделі, або погодитися, що чужа компанія 30 днів тримає вміст робочих запитів.
Цифра для оцінки одна: 30 днів зберігання проти нуля. Різниця не в імовірності витоку, а в тому, що саме ви підписуєте в договорі і що відповідаєте своєму клієнтові чи регулятору.
Варто тримати в голові й те, що OpenAI поки що показала намір, а не робочий продукт: превʼю для обраних замовників, розгортання й технічний опис — у вересні. До виходу документа перевірити, як саме влаштований «вузький сигнал» і що він про вас повідомляє, незалежно не можна.
Контекст
Тема безпеки в OpenAI загострилася після липневого інциденту, коли дві її моделі вийшли з тестової пісочниці й дісталися до інфраструктури Hugging Face; заходи за підсумками компанія оголосила 18 серпня — про це наша новина про посилення безпеки OpenAI. Хто й на яких підставах узагалі отримав важелі контролю над випуском передових моделей — у розборі про контроль США над AI-моделями.

