Головна/Новини/OpenAI впроваджує невидиме маркування текстів ChatGPT
§ новини

OpenAI впроваджує невидиме маркування текстів ChatGPT

Знайома ситуація: коли європейські регулятори беруться за правила гри для штучного інтелекту, техногігантам доводиться на ходу лагодити інструменти й…

2 хв

Знайома ситуація: коли європейські регулятори беруться за правила гри для штучного інтелекту, техногігантам доводиться на ходу лагодити інструменти й вигадувати нові кошики для комплаєнсу. OpenAI оголосила про впровадження невидимого маркування для згенерованих через ChatGPT і Codex текстів на території Європейського Союзу. Зміни стали прямим наслідком жорсткіших вимог європейського законодавства, але технічна реалізація викликає чимало питань у медіабайєрів та команд, які працюють із локальним контентом.

Як працює система textGrain та чому вона небездоганна

Нова технологія отримала назву textGrain. Вона додає до вихідного тексту статистичний сигнал через підбір специфічних синонімів та налаштування вибору слів на рівні моделі, не змінюючи загального сенсу чи читабельності.

OpenAI впроваджує невидиме маркування текстів ChatGPT

За даними внутрішніх тестів компанії, ефективність виявлення такого маркування залежить від обсягу тексту та початкових умов:

  • На пасажах довжиною у 200 токенів детектор розпізнає маркування приблизно у 80% випадків (за цільового рівня хибновільних спрацьовувань у 1%).

  • Для довших матеріалів на 400 токенів показник сягає близько 95%.

  • У вертикалях на кшталт математичних обчислень, де вибір лексики суворо обмежений, результати виявилися помітно нижчими.

Головний мінус системи полягає у її крихкості при редагуванні. Достатньо замінити лише 10% слів на синоніми в англомовних текстах на 400 токенів, щоб показник успішного детектування впав з 92% до 66%. Якщо ж переписати чи замінити 25% лексики, точність виявлення ледь сягає 17%. Через це вільний доступ до детектора на старті обмежений — перевірятимуть лише затверджені дослідники та профільні експертні організації.

Географія оновлень та API-опції

Анонсовані зміни впроваджуються поступово. Користувачі ChatGPT та Codex усіх тарифних планів у межах ЄС почнуть отримувати маркований контент найближчими тижнями. Глобального статусу за замовчуванням функція поки не має.

Для розробників, що працюють через API по всьому світу, доступний добровільний опції-режим (opt-in): активація маркування для окремих моделей за бажанням клієнта, хоча за замовчуванням воно вимкнене. Подробиці щодо конкретних моделей та можливості вимкнути водяні знаки європейським користувачам поки не уточнюються. Детальний розбір механіки та офіційну позицію платформи можна знайти в офіційному блозі OpenAI.

Чому це важливо для ринку та комплаєнсу

Формальним поштовхом стали вимоги статті 50 європейського AI Act, згідно з якими провайдери генеративного ШІ зобов'язані забезпечити машинну ідентифікацію контенту. Для компаній, що працюють одночасно на кілька ринків (наприклад, маючи команди у Берліні та за межами ЄС), виникає правова колізія.

Юристи зазначають, що використання результатів детектора як залізобетонного доказу авторства чи порушення внутрішніх контрактів стає беззмістовним. Навіть сама компанія наголошує: наявність чи відсутність водяного знака не доводить стовідсоткового авторства людини, не оцінює обсяг людського редагування та не підтверджує фактичну точність даних.

🤷‍♂️ Регулятори вимагають маркування «для галочки», але технологія розсипається від базового рерайтеру.

🖋 UAFF — будь в курсі арбітражних інсайтів

§ інші новини