Якщо замінити кожне десяте слово синонімом, точність виявлення тексту, написаного ШІ, падає з 92% до 66%. Цю цифру опублікувала сама OpenAI, презентуючи textGrain — нову систему невидимих водяних знаків для ChatGPT і Codex у Європейському Союзі.
Жодного видимого символу, який можна стерти, тут немає. Секретний ключ ледь помітно схиляє вибір слів моделі — сотні таких «підштовхувань» складаються у статистичний візерунок, непомітний для читача, але який вловлює алгоритм. OpenAI розробляла textGrain разом із дослідниками Пенсільванського та Єльського університетів.
Поспіх не випадковий. Норми прозорості європейського AI Act, що діють із 2 серпня, вимагають від компаній позначати контент, створений штучним інтелектом, у спосіб, який можна перевірити. Протягом найближчих тижнів користувачі ChatGPT і Codex у ЄС — на всіх тарифах, від безкоштовного до корпоративного — почнуть отримувати позначені тексти. Розробники, які працюють через API, можуть увімкнути функцію вже зараз у будь-якій країні для окремих моделей, хоча за замовчуванням вона вимкнена і глобальним стандартом поки не стала.
Доступ до самого детектора закритий: розпізнавати знак можуть лише перевірені дослідники й профільні організації, а не будь-який роботодавець чи вчитель. Та й надійність методу обмежена: на тексті з 400 токенів точність сягає 95% за рівня хибних спрацювань 1%, але після заміни чверті слів синонімами падає до 17%. Короткі відповіді, математичні розрахунки та переклади розпізнаються гірше, а відсутність знака сама по собі не доводить, що текст написала людина.
Цікаво, що Anthropic запровадила схоже маркування для Claude на два місяці раніше — і отримала критику користувачів, які побоювалися, що роботодавці почнуть вираховувати ШІ-тексти в листуванні й звітах. OpenAI, вочевидь, вирішила підготуватися до такої ж розмови заздалегідь: там окремо наголошують, що знак не розкриває ні акаунт, ні промпт, ні історію переписки — лише факт, що текст згенеровано моделлю.



