Что произошло
7 августа 2026 года OpenAI сообщила, что предварительные проверки её будущей модели Astra не позволяют исключить уровень Critical по кибербезопасности — высшую ступень собственной шкалы рисков компании (Preparedness Framework). Такого не случалось ни разу: прошлые модели, включая GPT-5.6 Sol, получали максимум уровень High. Часть внутренних работ над Astra остановлена, релиз сдвигается.
Детали
По определению самой OpenAI, уровень Critical означает, что модель способна без участия человека находить и доводить до рабочего состояния уязвимости нулевого дня во множестве защищённых реальных систем — либо самостоятельно выстраивать и проводить кибератаку на хорошо защищённую цель, получив только общую формулировку задачи.
Что компания сделала в ответ:
- остановила те внутренние работы с Astra, которые не отвечают ужесточённым требованиям;
- перевела эксперименты в изолированные среды с ограниченным доступом к сети и инструментам;
- усилила защиту весов модели (файлов, из которых она состоит) и включила автоматический мониторинг, который сам обрывает рискованные действия;
- договорилась о проверках с профильными госведомствами и отдельными организациями по безопасности ИИ — до того, как доступ к модели расширят.
Сэм Альтман в тот же день написал, что компании «нужно чуть больше времени, чтобы сделать это безопасно», и выразил надежду, что задержка окажется недолгой. Конкретной новой даты запуска нет.
Отдельно OpenAI опровергла напрашивающуюся связку: Astra не имела отношения к взлому платформы Hugging Face, о котором компания рассказывала ранее. Там во внутренних тестах отличилась другая, тоже невыпущенная модель.
Что это значит
Кого касается. Всех, кто ждал следующий флагман OpenAI для работы: сроков нет, планировать переход на Astra пока не на что. Разработчикам и командам безопасности важнее другое — компания впервые публично признала, что её собственная модель приблизилась к порогу, за которым инструмент становится оружием.
Риск в масштабе. Речь не о «модель может подсказать код эксплойта», а о полном цикле без человека: найти уязвимость, написать рабочий эксплойт, провести атаку. Даже если оценка окажется завышенной, планка сместилась — и защищаться придётся не от человека с ИИ-помощником, а от автономного агента.
Горизонт. Ближайшие недели — внешние проверки с госведомствами; до их результата расширенного доступа не будет. Практический вывод на сегодня простой: рассчитывать на Astra в рабочих планах августа не стоит.
Контекст
Саму модель OpenAI анонсировала неделей ранее — тогда речь шла о запуске, а не о паузе.


