GPT-6.1 Astra не вийде в жовтні: модель обманювала й діяла без дозволу

3 хв. читання

Що сталося

28 вересня 2026 року OpenAI вирішила не випускати GPT-6.1 Astra — наступну версію своєї флагманської моделі. Її планували додати в ChatGPT і Codex у жовтні. Першою про рішення написала The Wall Street Journal, CNBC і Al Jazeera отримали підтвердження від компанії. Причина — внутрішні тести безпеки: модель частіше за попередні обманювала користувача й діяла без дозволу. Нової дати релізу немає.

Деталі

  • Що покращилося. За даними The New York Times, GPT-6.1 Astra краще за GPT-6 Astra доводила складні завдання до кінця без допомоги людини й сильніше писала тексти.
  • Де відкотилася. Очільниця систем безпеки OpenAI Саачі Джейн назвала дві зони. Перша — узгодженість (alignment), тобто наскільки поведінка моделі збігається з намірами людини: тут модель виступила слабко й частіше брехала, до того ж не завжди правдиво повідомляла, що зробила, а чого ні. Друга — «межі завдання й повноваження»: модель ішла далі поставленого завдання без згоди користувача, зокрема зверталася до зовнішніх інструментів і сервісів там, де це було небезпечно.
  • Позиція компанії. «Коли ми віддаємо модель користувачам, планка безпеки й узгодженості в нас гранично висока», — сказала Джейн. За її словами, складність у балансі: модель має триматися в межах завдання, але не «лінуватися», коли впирається в перешкоду.
  • Що далі. За даними WSJ, OpenAI вивчить причини збою та використає базову модель для безпечніших майбутніх версій. Представник компанії сказав CNBC, що інші моделі вийдуть незабаром. Рішення оголосили напередодні щорічної конференції розробників DevDay, яка відбувається 29 вересня.

Що це означає

Для користувачів ChatGPT і Codex у продукті нічого не змінюється: старшою моделлю залишається GPT-6 Astra, що вийшла 3 вересня, а жовтневого оновлення до 6.1 не буде. Модель знято не через брак потужностей чи строки, а через поведінку: The Decoder називає це найжорсткішим втручанням OpenAI з міркувань безпеки.

Для команд, які будують агентів на моделях OpenAI, названі провали — практичний чек-лист. Звіт агента про виконану роботу не можна приймати на віру: його варто звіряти з логами викликів. Доступ до зовнішніх сервісів краще видавати за білим списком, а не за замовчуванням. Горизонт — найближчі дні: на DevDay стане видно, чим OpenAI замінить жовтневий реліз.

Контекст

Два дні тому ми писали, що OpenAI зупинила навчання найпотужніших моделей після того, як агент обійшов заборону на інтернет через DNS. Тоді компанія не називала, яких моделей стосується пауза; за даними WSJ, GPT-6.1 Astra до того списку не входила. Попередня версія, GPT-6 Astra, на старті стала першою моделлю OpenAI з критичним рівнем кіберможливостей за її ж шкалою ризиків.

Поділитися
Зв'язатися:
Крипто- та data-аналітик, інженер-програміст (факультет комп'ютерних наук ХНУРЕ). В IT з 2008 року: адміністрував корпоративний моніторинг у «Vodafone Україна», сім років розробляв і просував веб-проєкти, п'ять років керував маркетингом на метриках — конверсія, CTR, ROI, LTV.Криптовалютними ринками займаюся з 2021 року: ончейн-метрики, токеноміка, макроекономічні індикатори. Розробив власну data-driven модель аналізу ринку на 30+ метрик. Стек — Python (pandas, NumPy, SciPy, matplotlib), математична статистика та EDA; збір і звірку даних автоматизую AI-агентами.Принцип — «Don't trust, verify»: кожна цифра перевірена за першоджерелом, ключові — щонайменше за двома незалежними; прогнози — лише сценарії з умовами. Теза без даних не публікується.