Що сталося
7 серпня 2026 року OpenAI повідомила, що попередні перевірки її майбутньої моделі Astra не дають змоги виключити рівень Critical з кібербезпеки — найвищий щабель власної шкали ризиків компанії (Preparedness Framework). Такого не траплялося жодного разу: попередні моделі, зокрема GPT-5.6 Sol, отримували щонайбільше рівень High. Частину внутрішніх робіт над Astra зупинено, реліз зсувається.
Деталі
За визначенням самої OpenAI, рівень Critical означає, що модель здатна без участі людини знаходити й доводити до робочого стану вразливості нульового дня в багатьох захищених реальних системах — або самостійно вибудовувати й проводити кібератаку на добре захищену ціль, отримавши лише загальне формулювання завдання.
Що компанія зробила у відповідь:
- зупинила ті внутрішні роботи з Astra, які не відповідають посиленим вимогам;
- перевела експерименти в ізольовані середовища з обмеженим доступом до мережі та інструментів;
- посилила захист ваг моделі (файлів, з яких вона складається) і ввімкнула автоматичний моніторинг, що сам обриває ризиковані дії;
- домовилася про перевірки з профільними держвідомствами та окремими організаціями з безпеки ШІ — до того, як доступ до моделі розширять.
Сем Альтман того самого дня написав, що компанії «потрібно трохи більше часу, щоб зробити це безпечно», і висловив надію, що затримка буде недовгою. Конкретної нової дати запуску немає.
Окремо OpenAI спростувала напрошувану звʼязку: Astra не мала стосунку до злому платформи Hugging Face, про який компанія розповідала раніше. Там у внутрішніх тестах відзначилася інша, теж невипущена модель.
Що це означає
Кого стосується. Усіх, хто чекав наступний флагман OpenAI для роботи: строків немає, планувати перехід на Astra поки нема на що. Розробникам і командам безпеки важливіше інше — компанія вперше публічно визнала, що її власна модель наблизилася до порогу, за яким інструмент стає зброєю.
Ризик у масштабі. Ідеться не про «модель може підказати код експлойта», а про повний цикл без людини: знайти вразливість, написати робочий експлойт, провести атаку. Навіть якщо оцінка виявиться завищеною, планка зсунулася — і захищатися доведеться не від людини з ШІ-помічником, а від автономного агента.
Горизонт. Найближчі тижні — зовнішні перевірки з держвідомствами; до їхніх результатів розширеного доступу не буде. Практичний висновок на сьогодні простий: розраховувати на Astra в робочих планах серпня не варто.
Контекст
Саму модель OpenAI анонсувала тижнем раніше — тоді йшлося про запуск, а не про паузу.



