OpenAI внедряет невидимый водяной знак в текстах ChatGPT в ЕС

OpenAI внедряет невидимый водяной знак в текстах ChatGPT в ЕС - Фото 1

OpenAI начинает маркировать текст ChatGPT и Codex скрытый водяной знак в Евросоюзе — требования нового закона об искусственном интеллекте набирают обороты.

Компания объявила об изменении в в блоге в понедельник, объяснив этот шаг требованиями европейского закона об искусственном интеллекте (AI Act), правила о прозрачности которого вступили в силу 2 августа. Функция станет доступна пользователям всех тарифных планов ChatGPT и Codex в течение ближайших недель, но пока только в ЕС. Разработчики, работающие через API OpenAI, могут включить эту опцию для выбранных моделей уже сейчас в любой точке мира. По умолчанию она отключена.

Как это работает

Водяной знак ChatGPT не выглядит как символ или отметка. Технология под названием textGrain незаметно изменяет подбор слов моделью, оставляя паттерн, незаметный для глаза, но считываемый специальным детектором. Метка находится внутри самого текста, поэтому сохраняется даже после копирования в другой документ.

По словам компании, производительность моделей при включенном знаке не изменилась, а подпись не идентифицирует конкретного пользователя. Технический отчет о методе OpenAI подготовила совместно с исследователями из Пенсильванского и Йельского университетов.

Насколько легко обойти водяной знак ChatGPT

Надежность системы ограничена. В ходе внутренних тестов замена всего 10% слов синонимами снизила точность распознавания с 92% до 66%, то есть треть замененных фраз уже выходит из-под контроля. Короткие тексты, математические ответы и переводы распознаются ещё хуже. Именно поэтому доступ к детектору пока получат только проверенные исследователи и экспертные организации, а не широкая общественность. OpenAI прямо предупреждает: отсутствие водяного знака не доказывает человеческое авторство текста, ведь фрагмент мог быть сильно отредактирован или сгенерирован другой моделью.

Действия OpenAI повторяют шаги конкурента. Anthropic ввела водяной знак для Claude два месяца назад, причём сразу в глобальном масштабе. Решение вызвало недовольство части пользователей, которые настаивали, что именно они давали модели «инструкции, контекст и решения».

Сама OpenAI разработала подобную технологию ещё в 2024 году, по данным The Wall Street Journal, но тогда приостановила запуск, опасаясь ухода аудитории к конкурентам, не использующим маркировку.

Источник: OpenAI

Источник материала
loader
loader