OpenAI почне непомітно позначати тексти ChatGPT в ЄС

iEXExchanger
OpenAI почне непомітно позначати тексти ChatGPT в ЄС

OpenAI починає додавати невидимі водяні знаки textGrain у тексти ChatGPT і Codex для користувачів у ЄС — вимога AI Act. Знак погано переживає редагування тексту.

Якщо замінити кожне десяте слово синонімом, точність виявлення тексту, написаного ШІ, падає з 92% до 66%. Цю цифру опублікувала сама OpenAI, презентуючи textGrain — нову систему невидимих водяних знаків для ChatGPT і Codex у Європейському Союзі.

Жодного видимого символу, який можна стерти, тут немає. Секретний ключ ледь помітно схиляє вибір слів моделі — сотні таких «підштовхувань» складаються у статистичний візерунок, непомітний для читача, але який вловлює алгоритм. OpenAI розробляла textGrain разом із дослідниками Пенсільванського та Єльського університетів.

Поспіх не випадковий. Норми прозорості європейського AI Act, що діють із 2 серпня, вимагають від компаній позначати контент, створений штучним інтелектом, у спосіб, який можна перевірити. Протягом найближчих тижнів користувачі ChatGPT і Codex у ЄС — на всіх тарифах, від безкоштовного до корпоративного — почнуть отримувати позначені тексти. Розробники, які працюють через API, можуть увімкнути функцію вже зараз у будь-якій країні для окремих моделей, хоча за замовчуванням вона вимкнена і глобальним стандартом поки не стала.

Доступ до самого детектора закритий: розпізнавати знак можуть лише перевірені дослідники й профільні організації, а не будь-який роботодавець чи вчитель. Та й надійність методу обмежена: на тексті з 400 токенів точність сягає 95% за рівня хибних спрацювань 1%, але після заміни чверті слів синонімами падає до 17%. Короткі відповіді, математичні розрахунки та переклади розпізнаються гірше, а відсутність знака сама по собі не доводить, що текст написала людина.

Цікаво, що Anthropic запровадила схоже маркування для Claude на два місяці раніше — і отримала критику користувачів, які побоювалися, що роботодавці почнуть вираховувати ШІ-тексти в листуванні й звітах. OpenAI, вочевидь, вирішила підготуватися до такої ж розмови заздалегідь: там окремо наголошують, що знак не розкриває ні акаунт, ні промпт, ні історію переписки — лише факт, що текст згенеровано моделлю.

Запитання та відповіді

Часті питання на тему статті

Що таке textGrain і як це працює?

Це система невидимих водяних знаків OpenAI: секретний ключ ледь помітно впливає на вибір слів моделі, залишаючи статистичний візерунок, непомітний для читача, але який вловлює спеціальний інструмент.

Чому OpenAI запроваджує це лише в ЄС?

Цього вимагає європейський AI Act, який із 2 серпня зобов'язує компанії позначати контент від ШІ у спосіб, який можна перевірити. Розробники API можуть увімкнути функцію в будь-якій країні, але за замовчуванням вона вимкнена.

Чи можна видалити або обійти водяний знак?

Частково. Заміна 10% слів синонімами знижує точність виявлення з 92% до 66%, а заміна чверті слів — до 17%. Короткі тексти, математика й переклади розпізнаються ще гірше.

Хто може перевірити текст на наявність знака?

Наразі лише дослідники та організації, перевірені OpenAI — публічного детектора ще немає.

Читають також

Сбербанк і ВТБ офіційно увійшли на криптовалютний ринок Росії
Новини

Сбербанк і ВТБ офіційно увійшли на криптовалютний ринок Росії

Центробанк Росії опублікував перший реєстр крипто-операторів і кастодіанів — у списку Сбербанк, ВТБ та ще шість компаній. Для роздрібних інвесторів запровадили річний ліміт, Сбербанк запустить сервіс 1 грудня.

9 год тому
4 хв