OpenAI впроваджує невидимий водяний знак у текстах ChatGPT в ЄС
OpenAI починає позначати текст ChatGPT і Codex прихованим водяним знаком у Євросоюзі — вимога нового закону про штучний інтелект набирає обертів.
Компанія оголосила про зміну в блозі в понеділок, пояснивши крок вимогами європейського AI Act, чиї правила прозорості набули чинності 2 серпня. Функція з’явиться для користувачів усіх тарифів ChatGPT та Codex протягом найближчих тижнів, але поки що лише в ЄС. Розробники, які працюють через API OpenAI, можуть увімкнути опцію для обраних моделей вже зараз у будь-якій точці світу. Вона вимкнена за замовчуванням.
Як це працює
Водяний знак ChatGPT не виглядає як символ чи позначка. Технологія під назвою textGrain тонко змінює підбір слів моделлю, залишаючи патерн, непомітний для ока, але зчитуваний спеціальним детектором. Мітка живе всередині самого тексту, тому зберігається навіть після копіювання в інший документ.
За словами компанії, продуктивність моделей при ввімкненому знаку не змінилась, а підпис не ідентифікує конкретного користувача. Технічний звіт про метод OpenAI підготувала разом із дослідниками Пенсильванського та Єльського університетів.
Наскільки легко обійти водяний знак ChatGPT
Надійність системи обмежена. У внутрішніх тестах заміна лише 10% слів синонімами знизила точність розпізнавання з 92% до 66%, тобто третина підмінених фраз вже вислизає з-під контролю. Короткі тексти, математичні відповіді й переклади розпізнаються ще гірше. Саме тому доступ до детектора поки отримають лише перевірені дослідники й експертні організації, а не широкий загал. OpenAI прямо попереджає: відсутність водяного знака не доводить людське авторство тексту, адже фрагмент міг бути сильно відредагований або згенерований іншою моделлю.
Рух OpenAI повторює кроки конкурента. Anthropic запровадила водяний знак для Claude два місяці тому, причому одразу у глобальному масштабі. Рішення викликало незадоволення частини користувачів, які наполягали, що саме вони давали моделі “інструкції, контекст і рішення”.
Сама OpenAI розробила подібну технологію ще у 2024 році, за даними The Wall Street Journal, але тоді стримала запуск, побоюючись відтоку аудиторії до конкурентів без маркування.
Джерело: OpenAI

