Що сталося
5 жовтня 2026 року OpenAI представила textGrain — невидимий водяний знак для текстів своїх моделей. Найближчими тижнями він з’явиться у відповідях ChatGPT і Codex, які генеруються для користувачів у Євросоюзі. Привід — вимоги прозорості EU AI Act: з 2 серпня 2026 року текст, створений ШІ, має нести машинозчитувану позначку. Клієнти API в усьому світі можуть увімкнути знак для окремих моделей уже зараз, але за замовчуванням він вимкнений.
Деталі
- Як працює. Знак не ховається в метаданих чи невидимих символах. Модель трохи зміщує вибір слів за секретним ключем, і в тексті лишається статистичний візерунок. Людина його не бачить, а детектор із тим самим ключем перевіряє, чи є він у фрагменті (так описано в технічному звіті OpenAI).
- Чого знак не повідомляє. За словами OpenAI, він показує лише те, що частину тексту створила або обробила система компанії. Хто автор, кому належить текст і чи все в ньому правильно, детектор не скаже. Відсутність знака теж не доводить, що текст писала людина.
- Хто може перевірити. Доступ до детектора на старті отримають лише схвалені дослідники та експертні організації. Публічного інструмента «встав текст і дізнайся» немає.
- Точність за даними самої OpenAI. За частки хибних спрацювань 1% детектор розпізнає близько 95% фрагментів завдовжки 400 токенів (приблизно 300 англійських слів), близько 80% фрагментів у 200 токенів і лише близько 60% математичних відповідей. Якщо замінити синонімами 10% слів, частка розпізнаних падає з 92% до 66%, а в разі заміни 25% — до 17%.
- Порівняння. OpenAI стверджує, що у внутрішніх тестах textGrain не поступився іншим підходам, зокрема SynthID для тексту від Google DeepMind. Це заява компанії, незалежної перевірки поки немає.
Що це означає
Насамперед це стосується тих, хто користується ChatGPT або Codex із країн ЄС, зокрема українців, які там живуть. В Україні та інших країнах поза Євросоюзом відповіді ChatGPT знака поки не отримають. Для викладача чи редактора це поки не інструмент перевірки: детектор закритий, короткі відповіді він розпізнає погано, а після заміни синонімами чверті слів знаходить знак лише у 17% випадків. Тому позначка — сигнал, а не доказ авторства, а сторонні сервіси, які обіцяють визначити ШІ-текст, і далі помиляються: ми розбирали, як детектори ШІ-тексту дають хибні спрацювання на текстах живих авторів. Відчутним це стане, коли розгортання в ЄС завершиться і OpenAI відкриє детектор ширше.
Контекст
OpenAI не перша. Anthropic почала позначати тексти нових моделей Claude з 2 серпня 2026 року й робить це в усьому світі, бо не має надійного способу обмежити знак регіоном. OpenAI обрала інший шлях: обов’язковий знак лише в ЄС, для решти — на бажання розробника.
