Главная/Новости/OpenAI внедряет невидимую маркировку текстов ChatGPT
§ новости

OpenAI внедряет невидимую маркировку текстов ChatGPT

Знакомая ситуация: когда европейские регуляторы берутся за правила игры для искусственного интеллекта, техногигантам приходится на ходу чинить инструменты и…

2 мин

Знакомая ситуация: когда европейские регуляторы берутся за правила игры для искусственного интеллекта, техногигантам приходится на ходу чинить инструменты и придумывать новые корзины для комплаенса. OpenAI объявила о внедрении невидимой маркировки для сгенерированных через ChatGPT и Codex текстов на территории Европейского Союза. Изменения стали прямым следствием ужесточения требований европейского законодательства, но техническая реализация вызывает немало вопросов у медиабаеров и команд, работающих с локальным контентом.

Как работает система textGrain и почему она не безупречна

Новая технология получила название textGrain. Она добавляет к исходному тексту статистический сигнал через подбор специфических синонимов и настройку выбора слов на уровне модели, не изменяя общего смысла и читабельности.

OpenAI внедряет невидимую маркировку текстов ChatGPT

По данным внутренних тестов компании, эффективность обнаружения такой маркировки зависит от объёма текста и начальных условий:

  • На отрывках длиной в 200 токенов детектор распознаёт маркировку примерно в 80% случаев (при целевом уровне ложных срабатываний в 1%).

  • Для более длинных материалов на 400 токенов показатель достигает около 95%.

  • В вертикалях типа математических вычислений, где выбор лексики строго ограничен, результаты оказались заметно ниже.

Главный минус системы заключается в её хрупкости при редактировании. Достаточно заменить всего 10% слов на синонимы в англоязычных текстах на 400 токенов, чтобы показатель успешного детектирования упал с 92% до 66%. Если же переписать или заменить 25% лексики, точность обнаружения едва достигает 17%. Из-за этого свободный доступ к детектору на старте ограничен — проверять будут только утверждённые исследователи и профильные экспертные организации.

География обновлений и API-опции

Анонсированные изменения внедряются постепенно. Пользователи ChatGPT и Codex всех тарифных планов в пределах ЕС начнут получать маркированный контент в ближайшие недели. Глобального статуса по умолчанию функция пока не имеет.

Для разработчиков, работающих через API по всему миру, доступен добровольный опционный режим (opt-in): активация маркировки для отдельных моделей по желанию клиента, хотя по умолчанию она выключена. Подробности по конкретным моделям и возможности отключить водяные знаки европейским пользователям пока не уточняются. Детальный разбор механики и официальную позицию платформы можно найти в официальном блоге OpenAI.

Почему это важно для рынка и комплаенса

Формальным толчком стали требования статьи 50 европейского AI Act, согласно которым провайдеры генеративного ИИ обязаны обеспечить машинную идентификацию контента. Для компаний, работающих одновременно на несколько рынков (например, имея команды в Берлине и за пределами ЕС), возникает правовой коллизий.

Юристы отмечают, что использование результатов детектора как железобетонного доказательства авторства или нарушения внутренних контрактов становится бессмысленным. Даже сама компания подчёркивает: наличие или отсутствие водяного знака не доказывает стопроцентного авторства человека, не оценивает объём человеческого редактирования и не подтверждает фактическую точность данных.

🤷‍♂️ Регуляторы требуют маркировку «для галочки», но технология разваливается от базового рерайтера.

🖋 UAFF — будь в курсе арбитражных инсайтов

Источникsearchenginejournal.com
§ другие новости