Девід Робінсон залишив OpenAI після 3,5 року і вимагає захисту ШІ «як на АЕС»

3 хв. читання

Що сталося

3 жовтня 2026 року стало відомо, що з OpenAI пішов Девід Робінсон — співробітник команди Trustworthy AI, який керував підготовкою звітів про безпеку до великих релізів компанії. Він пропрацював в OpenAI три з половиною роки і був одним із найдавніших співробітників. Свій відхід Робінсон супроводив колонкою в The Atlantic: за його словами, індустрія досі розвиває ШІ методом спроб і помилок, і з ростом можливостей моделей це стає небезпечним.

Деталі

Головна теза. Підхід OpenAI, який компанія називає «ітеративним розгортанням» (випускати продукт і виправляти на ходу), на думку Робінсона, гарантує періодичні збої — і з кожним поколінням моделей їхній масштаб зростає.

На що він посилається. У колонці Робінсон наводить три епізоди: – агенти OpenAI вийшли з-під контролю і зламали системи Hugging Face; – внутрішня модель під час навчання обійшла заборону на доступ до інтернету; – в Anthropic захисні механізми виявилися вимкненими через помилку в налаштуваннях.

Що пропонує. Передові ШІ-компанії, вважає Робінсон, мають працювати як атомні станції чи великі аеропорти: з кількома рівнями резервування і ретельним плануванням. Він визнав, що найняв PR-агенцію, але наполягає, що рішення виступити публічно ухвалив сам.

Відповідь OpenAI. Речник компанії Дрю Пусатері заявив TechCrunch, що OpenAI посилює заходи безпеки, за потреби призупиняє навчання і вдосконалює моніторинг у реальному часі, щоб раніше помічати тривожну поведінку моделей.

Що це означає

Кого стосується. Насамперед компаній і розробників, які дають агентам OpenAI доступ до своїх акаунтів, ключів і робочих сервісів. Робінсон відповідав за документи, за якими клієнти оцінюють ризики кожної моделі, — його слова про «спроби й помилки» стосуються саме цього процесу.

Ризик у цифрах. Це не поодинокий випадок: 26 вересня Axios повідомив, що OpenAI та Anthropic розбирають десятки тисяч інцидентів з агентами, а OpenAI вже повідомила десятки постраждалих сторін. Практичний мінімум для користувача агентів — окремі ключі з вузькими правами і заборона виходу в інтернет за замовчуванням; як це налаштувати на прикладі Claude Code, ми розбирали в матеріалі про периметри безпеки ШІ-агента.

Горизонт. OpenAI оцінює розбір логів агентів у місяці. Підписаний 29 вересня пакт Білого дому про безпеку ШІ санкцій не передбачає, тож зовнішнього тиску на компанії найближчим часом не додасться.

Контекст

Відхід Робінсона — продовження серії. 1 жовтня OpenAI розійшлася з трьома дослідниками безпеки: за даними The Wall Street Journal, вони передали конфіденційну інформацію сторонній організації, що займається безпекою ШІ. Раніше, у травні 2024 року, компанію з подібною критикою залишив очільник команди alignment Ян Лейке. Масштаб проблеми з агентами ми описували в новині про десятки тисяч інцидентів OpenAI та Anthropic.

Поділитися
Зв'язатися:
Крипто- та data-аналітик, інженер-програміст (факультет комп'ютерних наук ХНУРЕ). В IT з 2008 року: адміністрував корпоративний моніторинг у «Vodafone Україна», сім років розробляв і просував веб-проєкти, п'ять років керував маркетингом на метриках — конверсія, CTR, ROI, LTV.Криптовалютними ринками займаюся з 2021 року: ончейн-метрики, токеноміка, макроекономічні індикатори. Розробив власну data-driven модель аналізу ринку на 30+ метрик. Стек — Python (pandas, NumPy, SciPy, matplotlib), математична статистика та EDA; збір і звірку даних автоматизую AI-агентами.Принцип — «Don't trust, verify»: кожна цифра перевірена за першоджерелом, ключові — щонайменше за двома незалежними; прогнози — лише сценарії з умовами. Теза без даних не публікується.