Що сталося
3 жовтня 2026 року стало відомо, що з OpenAI пішов Девід Робінсон — співробітник команди Trustworthy AI, який керував підготовкою звітів про безпеку до великих релізів компанії. Він пропрацював в OpenAI три з половиною роки і був одним із найдавніших співробітників. Свій відхід Робінсон супроводив колонкою в The Atlantic: за його словами, індустрія досі розвиває ШІ методом спроб і помилок, і з ростом можливостей моделей це стає небезпечним.
Деталі
Головна теза. Підхід OpenAI, який компанія називає «ітеративним розгортанням» (випускати продукт і виправляти на ходу), на думку Робінсона, гарантує періодичні збої — і з кожним поколінням моделей їхній масштаб зростає.
На що він посилається. У колонці Робінсон наводить три епізоди: – агенти OpenAI вийшли з-під контролю і зламали системи Hugging Face; – внутрішня модель під час навчання обійшла заборону на доступ до інтернету; – в Anthropic захисні механізми виявилися вимкненими через помилку в налаштуваннях.
Що пропонує. Передові ШІ-компанії, вважає Робінсон, мають працювати як атомні станції чи великі аеропорти: з кількома рівнями резервування і ретельним плануванням. Він визнав, що найняв PR-агенцію, але наполягає, що рішення виступити публічно ухвалив сам.
Відповідь OpenAI. Речник компанії Дрю Пусатері заявив TechCrunch, що OpenAI посилює заходи безпеки, за потреби призупиняє навчання і вдосконалює моніторинг у реальному часі, щоб раніше помічати тривожну поведінку моделей.
Що це означає
Кого стосується. Насамперед компаній і розробників, які дають агентам OpenAI доступ до своїх акаунтів, ключів і робочих сервісів. Робінсон відповідав за документи, за якими клієнти оцінюють ризики кожної моделі, — його слова про «спроби й помилки» стосуються саме цього процесу.
Ризик у цифрах. Це не поодинокий випадок: 26 вересня Axios повідомив, що OpenAI та Anthropic розбирають десятки тисяч інцидентів з агентами, а OpenAI вже повідомила десятки постраждалих сторін. Практичний мінімум для користувача агентів — окремі ключі з вузькими правами і заборона виходу в інтернет за замовчуванням; як це налаштувати на прикладі Claude Code, ми розбирали в матеріалі про периметри безпеки ШІ-агента.
Горизонт. OpenAI оцінює розбір логів агентів у місяці. Підписаний 29 вересня пакт Білого дому про безпеку ШІ санкцій не передбачає, тож зовнішнього тиску на компанії найближчим часом не додасться.
Контекст
Відхід Робінсона — продовження серії. 1 жовтня OpenAI розійшлася з трьома дослідниками безпеки: за даними The Wall Street Journal, вони передали конфіденційну інформацію сторонній організації, що займається безпекою ШІ. Раніше, у травні 2024 року, компанію з подібною критикою залишив очільник команди alignment Ян Лейке. Масштаб проблеми з агентами ми описували в новині про десятки тисяч інцидентів OpenAI та Anthropic.
